Heard
Приложение для строки меню macOS, которое превращает вывод кодинг-агента в голосовые обновления, позволяя разработчикам отходить от экрана, не теряя из виду прогресс.
Сообщество:
Обзор продукта
Что такое Heard?
Heard — это бесплатная утилита с открытым исходным кодом для macOS, которая даёт голос agentic-инструментам для кодинга, таким как Claude Code, OpenAI Codex и Cursor. Вместо того чтобы следить за прокруткой терминала, разработчики слышат краткие голосовые сводки о том, что делает их агент, что он находит или что запрашивает, — это позволяет отойти от рабочего места, заниматься несколькими делами сразу или следить за несколькими сессиями одновременно. Приложение работает как лёгкий клиент в строке меню, поддерживает как полностью локальный синтез речи, так и премиальные облачные голоса, и специально создано для правильного произношения кода, путей к файлам и жаргона разработчиков вместо того, чтобы искажать их, как обычный синтез речи.
Ключевые функции
Озвучивание агента в речь
Преобразует необработанный вывод Claude Code, Codex и Cursor в чёткие, естественно звучащие голосовые обновления в реальном времени.
Гибкие голосовые движки
Из коробки работает на бесплатных локальных голосах Kokoro либо подключается через собственный API-ключ (BYOK) к ElevenLabs, Anthropic или OpenAI для более качественного звучания или кастомных голосов.
Создано для кода
Обработка речи прямо на Mac и словарь, заточенный под разработчиков, сохраняют технические термины, имена функций и пути к файлам без искажений.
Режимы прослушивания
Режимы Co-pilot, Companion и Focus позволяют настроить, сколько деталей и прерываний нужно во время работы агента.
Управление сессией
Горячие клавиши паузы/продолжения и автоматическая пауза во время звонков не дают озвучке мешать встречам или другому звуку.
Приватное сопряжение с ограниченной областью
Явные, ограниченные по области подключения к агентам гарантируют, что приложение слушает только те сессии, которые одобрил пользователь, без постоянного фонового прослушивания.
Варианты использования
- Мониторинг без рук : Разработчики могут отойти от рабочего места во время долгих запусков агента и всё равно отслеживать прогресс, ошибки или завершение по звуку.
- Многозадачность во время сборки : Инженеры могут заниматься другими задачами или участвовать в звонках, пока голосовые обновления сообщают, когда агенту нужен ввод или он завершил шаг.
- Программирование, доступное для всех : Голосовое озвучивание предлагает альтернативный способ взаимодействия для разработчиков, которые предпочитают меньше полагаться на постоянное чтение с экрана.
- Надзор за несколькими агентами : Команды, запускающие несколько кодинг-агентов параллельно, могут различать и отслеживать статус каждой сессии по разным голосовым сигналам.
- Голосовой слой White-Label : Продуктовые команды могут встроить API и SDK озвучивания Heard, чтобы добавить голосового ко-пилота в собственные agentic-продукты.
Часто задаваемые вопросы
Альтернативы Heard
SFX Engine
Генератор звуковых эффектов на базе AI для создания индивидуального, не требующего роялти аудио для мультимедийных проектов с гибкой оплатой по факту использования.
KickBot
Облачный чат-бот и набор инструментов для стриминга на Kick.com с AI-функциями, инструментами модерации и управления контентом.
Speechify
AI-платформа для преобразования текста в речь, предлагающая естественные голоса, voice cloning и инструменты для создания мультимедийного контента.
NaturalReaders
Программное обеспечение на базе AI для преобразования текста в речь с реалистичным синтезом голоса, поддержкой многих языков и функциями доступности.
Luvvoice
AI-платформа для преобразования текста в речь с более чем 200 естественными голосами на 70+ языках и настраиваемыми параметрами речи.
TTSMaker
Универсальная AI-платформа text-to-speech с естественными голосами на многих языках и возможностью настройки стиля и эмоций.
ElevenReader
AI-приложение для преобразования текста в речь с ультрареалистичной озвучкой для электронных книг, PDF, веб-статей и другого контента на 32 языках.
SpeechGen
AI-конвертер текста в речь для генерации реалистичных озвучек с настраиваемыми параметрами и поддержкой множества языков.
