Heard

Голосовой слой для macOS, превращающий вывод терминала Claude Code, Codex и Cursor в умные голосовые сводки

Подробный отчёт

  • Heard — это речевой уровень macOS, предназначенный для рабочих процессов агента программирования искусственного интеллекта. Он соединяет Claude Code, OpenAI Codex и Cursor для преобразования вывода терминала в интеллектуальные речевые сводки. Он был запущен на Product Hunt 25 июля 2026 года и занял первое место в тот день (339 голосов, 91 комментарий). Он имеет открытый исходный код (Apache-2.0) и бесплатен для частных лиц. Основная идея состоит в том, чтобы «вещать с суждением» — не просто преобразовывать текст в речь, но и различать, что следует сказать, а что следует пропустить.

  • Келли (@itskellysun), основатель Heard, рассказала об этом на Product Hunt: «Последние два года все пытались упростить общение с агентом — голосовой ввод, лучшие подсказки, лучший контекст. Но никто не делает вторую половину. Ответ агента по-прежнему заключается в прокрутке текста, на который приходится сидеть и смотреть. Heard — это половина». Судя по хронологии, Херд выпустил раннюю версию в сообществе ещё 1 мая 2026 года, а затем вошел в поле зрения английских технологических СМИ, таких как AI Untethered. После официального запуска на Product Hunt 25 июля он получил 339 голосов и 91 комментарий, заняв первое место в тот день. В настоящее время продукт находится на ранней стадии быстрого роста, и китайских технологических СМИ (36Kr, Minority и т. д.) нет специального репортажа. Стоит отметить, что доменное имя Heard.app в настоящее время указывает на совершенно другой технологический продукт для слуховых аппаратов, а фактический вход на официальный сайт Heard в настоящее время доступен в основном через страницу Product Hunt. В продукте используется демон Python с сокетами Unix, механизм TTS поддерживает ElevenLabs (облако) и Kokoro (локально), а также использует Claude Haiku 4.5 для обработки перезаписи личности.

  • Основным механизмом Heard является «оценочная отчетность», которая представляет собой двухуровневую систему принятия решений. Первый уровень называется жесткими сигналами: запросы разрешений, сбои вызова инструментов, завершение запуска — они всегда запускают голосовые трансляции. Второй уровень — контекстно-зависимый: он отслеживает историю разговоров, определяет, какой контент стоит сказать, и пропускает избыточную информацию. Продукт обеспечивает три режима мониторинга. Режим второго пилота дает вам короткие подсказки во время работы, не читая их дословно; Режим Companion обеспечивает более полную голосовую информацию, когда вы находитесь вдали от экрана; Режим фокусировки молчит и говорит только тогда, когда требуется ваше вмешательство (одобрение, блокировка, отказ). Многоагентная параллельная обработка — уникальное преимущество Heard. При одновременном запуске нескольких сеансов ИИ (Claude Code, Codex, Cursor) у Heard нет пяти терминалов, наложенных друг на друга, а суммируется на уровне проекта, и каждый агент использует свой звук, что позволяет на слух различать, кто что делает. Функция сопряжения с мобильным телефоном (Heard Power) осуществляется с помощью одноразового QR-кода. После сопряжения вы сможете слушать трансляцию в режиме реального времени, даже когда экран заблокирован. Он также поддерживает нажатие и удерживание или нажатие, чтобы произнести команду, чтобы отправить инструкции интеллектуальному агенту. Сопряжение осциллографов и автоматическое отключение обеспечивают безопасность. Система голосовой идентификации также очень сложна. Есть четыре встроенных личности: Ария (спокойная и непосредственная), Пятница (яркая и живая), Джарвис (спокойная и остроумная, по умолчанию) и Атлас (драматичная). Вы также можете настроить свою индивидуальность с помощью файлов Markdown. С точки зрения конфиденциальности, основной движок Apache-2.0 имеет открытый исходный код и полностью размещается на собственном хостинге. Состояние сеанса сохраняется только в локальной памяти и на диске, а не в сети. Мобильный телефон передает только звук и не передает статус сеанса.

  • У Heard есть три уровня цен. Бесплатный план бессрочно бесплатен и включает в себя собственные голоса Кокоро, встроенный искусственный интеллект и голосовые клавиши, персонализированные персональные настройки и горячие клавиши, а также основан на движке с открытым исходным кодом. План Pro стоит 12 долларов в месяц (оплачивается ежегодно) и предлагает управляемую голосовую связь и LLM (самостоятельная настройка не требуется), отчеты в течение всего дня, персональные настройки премиум-класса (Atlas и Friday) и облачную синхронизацию между Mac. План Power стоит 24 доллара в месяц (оплачивается ежегодно) и включает в себя все функции Pro plus Heard Mobile, распознавание речи с оптимизацией кода, а также возможности голосового утверждения и перенаправления агента. Для планов хостинга требуется macOS 13 или выше. Такая ценовая стратегия более разумна: бесплатная версия позволяет отдельным разработчикам попробовать и оценить ее при небольших затратах, версия Pro решает потребности пользователей, которые не хотят самостоятельно возиться с настройкой API, а версия Power предназначена для активных пользователей и сценариев мобильного офиса.

  • Feedback from the Product Hunt community has been overall positive. Пользователь Уэс Карлсон прокомментировал: «Параллельная работа агента делает разделение жестких сигналов и понимание контекста ощущением основного дизайнерского решения, а не просто функцией уведомления». Dogan Akbulut said: "I always miss the moment when the agent is waiting for permission prompts, wasting 20 minutes. Love this near-silent mode." Noctis Leonard believes that the Verbosity knob and project-level summary are the right infrastructure for working in parallel. Многие пользователи также задавали хорошие вопросы. Gal Dayan is concerned with how Heard decides what is worth saying when several parallel agents are running different tasks. Другие спрашивали о механизме прерывания голоса, месте хранения статуса разговора и т. д. Основатель ответил на эти технические вопросы в области комментариев и был вполне откровенен.

  • Что касается английских технологических СМИ, AI Untethered впервые сообщила на Heard 1 мая, процитировав основателя: «Самое сложное — не TTS, а решить, чего не говорить». daily.dev также сделал введение после выпуска PH, сосредоточив внимание на технических принципах двухуровневой системы принятия решений. Агрегаторы инструментов, такие как AIToolly и AIDeckly, предоставляют полные функции и информацию о ценах. С точки зрения отрасли, Херд заполняет упускаемый из виду пробел. Большинство инструментов программирования ИИ фокусируются только на «вводе» — на том, как пользователь разговаривает с агентом. Вопрос о том, как агент «выводит» его пользователю, никогда не воспринимался всерьез. Именно эту проблему вывода решил решить Херд. В контексте растущей популярности программных агентов искусственного интеллекта действительно существует спрос на это направление «взаимодействия человека с компьютером, прежде всего аудио». Однако в настоящее время в китайских СМИ почти нет сообщений о Херд. Это может быть связано с тем, что продукт распространяется только в англоязычном сообществе и доменное имя официального сайта указывает на другой продукт.

  • В настоящее время у Херд нет серьезных споров или юридических рисков. Но есть несколько потенциальных проблем, на которые стоит обратить внимание. Во-первых, это разделение позиционирования продукта и доменного имени: Heard.app указывает на технологию слуховых аппаратов, а не на продукты с голосовым слоем искусственного интеллекта, что может вызвать путаницу у пользователей, а также повлиять на естественное получение трафика. Во-вторых, существует конкурентное давление продукта: был запущен официальный голосовой режим Claude Code от Anthropic, а альтернативы с открытым исходным кодом, такие как VoiceMode MCP, также продолжают развиваться. Херд должен установить достаточные технические барьеры. Третье — ценообразование. План Power за 24 доллара не является дорогим в области инструментов искусственного интеллекта, но если основные конкурирующие продукты имеют открытый исходный код и бесплатны, ему необходимо продолжать доказывать уникальную ценность платных функций.

  • Heard лучше всего подходит трем типам людей. Первая категория — это отдельные разработчики, которые ежедневно используют Claude Code или Codex, особенно те, кто не хочет постоянно быть привязанным к терминалу. Вторая категория — это разработчики, которые работают в удаленных или мобильных сценариях и могут использовать время в пути и прогулках, чтобы следить за прогрессом агента. Третья категория — это активные пользователи, которые одновременно запускают несколько агентов и которым требуется сводная информация на уровне проекта, а не переключаться между различными терминалами. К неподходящим людям относятся: разработчики, использующие Windows или Linux (пока не поддерживаются, но официальные кроссплатформенные планы подтверждены), разработчики, которым не нужна голосовая обратная связь, и пользователи, которые реже используют агенты программирования ИИ. Если вам не нужен собственный интерфейс macOS, в качестве альтернативы можно использовать VoiceMode MCP или встроенный /voice режим Claude Code.

  • Херд решает реальную, но легко упускаемую из виду проблему — выходной опыт агентов, запрограммированных на основе искусственного интеллекта. Дизайн продукта тщательно продуман, от жесткого двухуровневого принятия решений с учетом сигнала/контекста до независимого от нескольких агентов тембра, и понимание фактического рабочего процесса можно увидеть в каждой функциональной точке. Ядро с открытым исходным кодом и трехуровневая ценовая стратегия также предоставляют пользователям гибкий выбор. Срок выпуска продукта небольшой (всего 2 дня), а последующие разработки достойны внимания, особенно кроссплатформенная поддержка и продвижение китайского сообщества.

Отзывы пользователей

  • аватар
    Cynthia_RodriguezII
    Параллельная обработка несколькими агентами — настоящее спасение. Раньше метался между четырьмя окнами терминала, голова шла кругом. Теперь каждый агент говорит своим голосом, и я с закрытыми глазами знаю, кто чем занят.

  • аватар
    LUphi
    Только что попробовал режим Companion в Heard. Отошёл за кофе и всю дорогу слушал, как Codex в фоне рефакторит мой старый проект. Вернулся — код готов, даже тесты прошли. Потрясающее ощущение.

  • аватар
    TendermintTina54
    Режим Focus — мой любимый. Он не болтает без умолку, а говорит только при ошибке или когда нужно моё одобрение. Раньше с Claude Code я нередко впустую ждал по двадцать минут, не заметив запрос прав, — теперь такого нет.

  • аватар
    Anthony.Rogers58
    Попробовал сопряжение с телефоном: один скан QR-кода — и готово. Даже с заблокированным экраном слышно оповещения, а зажав кнопку, можно говорить и отправлять агенту команды. Гуляешь на улице и следишь за прогрессом — технологии меняют жизнь.

  • аватар
    Diane_Price_77
    Открытый код под Apache-2.0 плюс бесплатный тариф — искренность на высшем уровне. Локальный голос Kokoro не так естественен, как ElevenLabs, но возможность запустить всё бесплатно — уже отличный бонус.

  • аватар
    Logan216
    Heard превращает вывод агента в голос — направление выбрано абсолютно верно. Все заняты голосовым вводом, а выводом никто не занимается. Основатель прав: агент по-прежнему отвечает прокручивающимся текстом, и приходится сидеть и пялиться в него.

  • аватар
    谢秀
    В тот же день первое место на PH с 330 голосами — значит, спрос реально есть. Ниша инструментов для разработчиков дико конкурентная, взять первое место непросто.

  • аватар
    梅花_15
    Вчера перед уходом с работы запустил сразу трёх агентов на разные задачи: Claude Code рефакторил backend API, Codex писал фронтенд-компоненты, Cursor гонял тесты. Heard озвучивал прогресс каждого тремя разными голосами: персона Aria особенно чётко рассказывала про API, а Friday бодрым тоном сообщала о фронтенде — перепутать невозможно. По пути один агент застрял на подтверждении прав, режим Focus тут же прислал голосовое напоминание; я нажал «одобрить», и всё продолжилось. В итоге по дороге домой дослушал остальные оповещения на телефоне, а дома открыл компьютер — все три задачи выполнены. Раньше о таком и мечтать не приходилось.

  • аватар
    Nancy8552024
    У четырёх голосовых персон свой характер у каждой. Попробовал Friday — лёгкий стиль действительно подходит для долгих сессий программирования. Открытый дизайн с настройкой персоны через Markdown тоже придуман здорово.

  • аватар
    DWhite_Pro509
    Тариф Pro — 12 долларов в месяц, голос и LLM хостятся у них, свой API настраивать не нужно. Для тех, кто не хочет возиться, вполне выгодно, но я сначала погоняю бесплатную версию.

  • аватар
    goldenmouse658
    Больше всего зацепила фраза: «самое сложное — не TTS, а решить, чего говорить не надо». Убавлять гораздо труднее, чем добавлять, и Heard действительно отлично фильтрует шум: он не превращает весь вывод терминала в речь, а отбирает с рассудительностью.

  • аватар
    郝玉梅
    Почитал обсуждение на Product Hunt — основатель очень откровенно отвечает на технические вопросы. Состояние сессии хранится в локальной памяти и на диске, на телефон передаётся только звук, без состояния. Такой подход к приватности внушает доверие.

  • аватар
    NSullivan
    Я перешёл с открытого проекта claude_voice. Опыт с Heard намного лучше — это продукты разного уровня. Они действительно реализовали «озвучивание с рассудительностью», а не простое чтение TTS. К тому же архитектура Heard легче: связка Python-демон плюс Unix-сокет куда элегантнее, чем поднимать Node-сервис ради TTS, и ресурсов ест меньше.

  • аватар
    AustinMorales168224
    Тариф Power за 24 доллара в месяц дороговат, но включает мобильную версию и голосовое подтверждение. Мне, часто бывающему в разъездах, это действительно нужно; попробую месяц и посмотрю, стоит ли. Если мобильный опыт окажется достаточно хорош, цена в общем приемлемая.

  • аватар
    Ryan_StephensJr5
    Есть вопрос: если два параллельных агента сообщают противоречивые результаты — один говорит, что миграция удалась, другой — что тесты упали, — как Heard это сведёт? Видел ответ основателя на PH: используется механизм reasoning-pass override; сначала выпустить, потом оптимизировать.

  • аватар
    AnnMendozaII
    Архитектура Heard на Python-демоне и Unix-сокете довольно лёгкая, ресурсы почти не ест. Гораздо чище, чем решения-обёртки на Electron. Использовать Claude Haiku 4.5 для переписывания под персону — тоже креативный ход.

  • аватар
    CHOKM0F
    Разработчики говорят, что в будущем будет поддержка Linux и Windows — отлично. Мой основной компьютер Mac, но когда изредка сажусь за Windows, тоже должно работать.

  • аватар
    钱建晴
    Сегодня попробовал в шумной кофейне — Heard всё равно озвучивал очень чётко. Фоновый шум немного мешал, но сам голос достаточно громкий: в AirPods всё прекрасно слышно.

  • аватар
    TheHelenaVergara
    В режиме Co-pilot он лишь изредка вставляет слово во время работы, не прерывая ход мысли. Будто коллега рядом тихо подсказывает: «тесты прошли», «там ошибка, взгляни». Баланс выдержан идеально.

  • аватар
    KrinHarper
    Целый день гонял Claude Code на рефакторинге кодовой базы с Heard — опыт превзошёл ожидания. Я не только слышу прогресс, но и вовремя получаю напоминание, когда Agent застревает и ждёт моего решения. По сравнению с прежним разглядыванием терминала эффективность выросла заметно. Открытое ядро плюс три тарифа дают пользователю достаточно выбора.

  • аватар
    春雨_5
    Давно ждал инструмент, который превращает вывод Agent в голос, — наконец кто-то его сделал. Немного беспокоит, что домен heard.app ведёт на продукт слуховых технологий, который не имеет отношения к этому Heard, — это может запутать людей. Надеюсь, команда скоро решит вопрос с доменом.

  • аватар
    梅花40
    С облачным TTS от ElevenLabs звучание действительно очень естественное. Но и локального Kokoro вполне хватает, к тому же экономия на API. У каждого варианта свои компромиссы.

  • аватар
    流年393
    Self-hosting — это здорово: всё работает локально, код и данные не покидают машину. Для проектов с требованиями комплаенса такая архитектура очень важна. Подход, при котором на телефон передаётся только звук без состояния, тоже успокаивает.

  • аватар
    TerryGonzalezQ8
    Конкурентное давление налицо: официальный режим /voice в Claude Code от Anthropic уже вышел, VoiceMode MCP тоже развивается. Надеюсь, Heard сохранит техническое преимущество и его не задавят гиганты. Впрочем, Heard занимается голосовыми оповещениями на стороне вывода, а официальная фича — это голосовой ввод; это разные дорожки, скорее взаимодополняющие, чем конкурирующие.

  • аватар
    nty8ahuejt
    После установки режим переключается прямо из строки меню — без перезапуска и без команд. Очень маковский дизайн взаимодействия. Как пользователь экосистемы Apple, я в восторге.

  • аватар
    8domk0e_i3j
    Одна деталь: регулятор Verbosity в Heard позволяет тонко настраивать объём озвучивания — от полного комментария до только ошибок. При параллельной работе сводка на уровне проекта куда лучше, чем слушать, как пять терминалов накладываются друг на друга. Советую попробовать каждому разработчику, использующему Claude Code.

  • аватар
    夏明
    Последние пару дней использую Heard вместе с Cursor для фронтенда — очень удобно. Подстраиваю стили и одновременно слушаю, как Agent докладывает о статусе, не нужно постоянно переключаться между экранами. Продуктивность заметно выросла, особенно приятно, что во время прогона тестов больше не приходится сидеть и ждать впустую.

  • аватар
    LucaKumar
    Отсутствие поддержки Windows и Linux — это действительно слабое место. Надеюсь, кроссплатформенный план из дорожной карты скоро реализуют, иначе коллеги в команде с разными системами не смогут пользоваться им единообразно.