Перейти к содержимому
Hermes Agent v0.20.0: голос, A2A, вебхуки и надёжная автоматизация
7 мин чтения

Hermes Agent v0.20.0: голос, A2A, вебхуки и надёжная автоматизация

hermes-agentai-agentsvoice-aiagent-to-agentwebhooksdeveloper-tools

Дата релиза: 3 августа 2026 года. Разработчик: NousResearch. Тег: v2026.8.3.

С версии v0.19.0 проект получил около 3 650 коммитов, примерно 1 400 объединённых запросов на слияние, изменения в 5 200 файлах, порядка 559 тысяч добавлений и 405 тысяч удалений. Закрыто около 1 200 задач, в работе участвовали более 650 человек. Масштаб, прямо скажем, не косметический.

Релиз «Вестник». Гермес в древнегреческой мифологии был посланником богов — и в этой версии агент заметно приближается к своему имени. Он умеет вести потоковый голосовой диалог, передавать задачи другим агентам через A2A v1.0, отправлять события во внешние системы подписанными вебхуками и готовить исследования с проверяемыми источниками. Параллельно desktop-приложение превращается в полноценную рабочую среду, CLI обзаводится новыми командами, а механизмы сжатия контекста и восстановления инструментов становятся заметно практичнее.

Ключевые изменения Hermes Agent v0.20.0

Потоковый голосовой диалог с возможностью перебивания

Голосовой режим больше не заставляет пользователя ждать, пока агент сгенерирует и озвучит весь ответ целиком. Hermes начинает говорить по мере формирования текста; его можно прервать прямо в середине фразы, просто начав говорить. Агент остановится, выслушает собеседника и получит сигнал о прерывании текущего ответа.

Определение пауз учитывает активность пользователя, поэтому система не должна говорить поверх человека. Возможность доступна в голосовом режиме CLI, desktop-приложении и gateway-адаптерах с поддержкой аудио. В итоге взаимодействие больше похоже на разговор, а не на обмен длинными голосовыми сообщениями. См. PR #69511.

Фразы активации и управление без рук

Пользователь может задать собственную фразу активации — например, «Привет, Hermes». Распознавание выполняется локально: пока агент ожидает команды, аудиоданные не уходят с компьютера. Несколько фраз активации можно привязать к разным профилям, а голосовая команда «стоп» завершает сессию без клавиатуры.

Для сценариев без использования рук это важный шаг: с терминалом и агентом можно работать буквально из другого конца комнаты. Не всем это нужно каждый день, но в лаборатории, мастерской или во время демонстрации функция выглядит весьма к месту.

Голосовые сообщения на разных платформах

Hermes принимает и обрабатывает голосовые сообщения из WhatsApp, Feishu, DingTalk, LINE, QQ, Photon и Weixin. Сообщения транскрибируются, а ответы при необходимости озвучиваются с учётом требований конкретной платформы: например, используется Opus там, где он обязателен, а субтитры прикрепляются корректно.

Настройки STT вынесены в отдельную категорию hermes tools, появились элементы управления в графическом интерфейсе и панели управления, улучшено определение языка, добавлена поддержка OpenAI gpt-transcribe. Общий препроцессор очищает текст для озвучивания от Markdown, кода и URL — мелочь, но слушать «звёздочка-звёздочка» никому не хочется.

Исследования с подтверждаемыми цитатами

Новый навык grounded-citations помогает готовить материалы, в которых утверждения привязаны к проверяемым источникам. Цитаты сопоставляются с фактическим содержимым страницы, ссылки ведут к конкретным доказательствам, а режим фактчекинга оценивает переданные документы и тезисы: что подтверждается, что опровергается и что проверить не удалось.

Для корпоративных сценариев это особенно полезно. Агентная автоматизация, работающая с исследованиями, политиками и внутренними документами, должна не просто звучать убедительно — она должна оставлять проверяемый след. Такой подход хорошо сочетается с задачами аудита и соответствия требованиям для AI-агентов.

Подписанные исходящие вебхуки

Hermes теперь отправляет события жизненного цикла на зарегистрированные HTTP-конечные точки: активность сессии, завершение хода, события инструментов и другие сигналы. Запросы подписываются HMAC-подписями, чтобы принимающая система могла проверить их подлинность.

Это упрощает интеграцию агента с CI/CD, внутренними панелями управления, системами домашней автоматизации и корпоративными сервисами. Вместо постоянного опроса API система получает событие тогда, когда оно действительно произошло.

Desktop-приложение становится рабочей платформой

Desktop-версия получила поддержку артефактов: это версионируемые карточки с изолированным предпросмотром в реальном времени в правой панели. Сгенерированные HTML-приложения можно запускать рядом с чатом, не покидая рабочую среду.

Также представлены SDK плагинов, первый плагин Kanban, метод ctx.download для передачи файлов пользователю, плавающие панели, поддержка нескольких окон и окно быстрого ввода, вызываемое глобальной горячей клавишей. Hermes Desktop всё меньше напоминает обычный чат-клиент и всё больше — среду для повседневной работы с агентами.

A2A v1.0: взаимодействие между агентами

Встроенный плагин реализует протокол Agent-to-Agent версии 1.0. Hermes может обнаруживать совместимых агентов, взаимодействовать с ними и принимать управление от них. Закрыта задача #514, один из самых давних запросов на новые функции в репозитории.

Для компаний, строящих мультиагентную архитектуру на разнородных технологических стеках, стандартизированный протокол связи снимает часть интеграционной головной боли. Агентам наконец не обязательно общаться жестами и самописными адаптерами.

Новые возможности CLI для опытных пользователей

  • !command запускает команду оболочки без расходования хода модели;
  • /init анализирует проект и создаёт либо обновляет файл AGENTS.md;
  • /diff показывает staged-, all- и session-изменения;
  • /context объясняет, чем заполнено контекстное окно;
  • /focus включает режим сокращённого вывода с возможностью вернуть скрытые строки;
  • Ctrl+S сохраняет недописанный запрос в отдельную панель;
  • hermes import-agent переносит конфигурацию Claude Code или Codex CLI одной командой.

Набор команд ориентирован на тех, кто работает с агентом в терминале часами, а не открывает его раз в неделю «на посмотреть».

Перенаправление агента во время выполнения задачи

Если Hermes пошёл не туда, теперь не обязательно останавливать выполнение и формулировать задачу заново. Пользователь может добавить уточнение в процессе работы: текущий ход будет перенаправлен, выполненные действия сохранятся, а агент скорректирует курс с учётом новой инструкции.

Вместе с отменой черновика двойным нажатием ESC и стеком отмены в редакторе это делает управление ближе к обычному редактированию. Быстрее, спокойнее, без лишнего ритуала.

Самовосстановление инструментов и более долгие автономные запуски

Инструменты стали устойчивее к собственным ошибкам. Усечённый вывод терминала сохраняется в файл, доступный агенту; patch распознаёт уже применённые изменения и диагностирует расхождения в пробелах; write_file сверяет содержимое с файлом на диске; поисковые запросы без совпадений пытаются найти близкие варианты.

Лимит итераций вызова инструментов по умолчанию увеличен с 90 до 500. Это важно для длительных автономных задач и для инженерной разработки автономных агентов, где надёжность выполнения часто ценнее эффектной демонстрации на одном удачном запросе.

Бережное сжатие контекста и агентная память

Механизм сжатия контекста переработан: добавлена предварительная очистка результатов инструментов для моделей с большими контекстными окнами, микрокомпактизация на каждом ходу, сохранение последних N сообщений пользователя, тайм-ауты с учётом прогресса и защита от «призрачных» навыков после их удаления.

Пороговые значения можно задавать отдельно для каждой модели и в абсолютных токенах. Длинные диалоги должны сохранять связность и реже зависать. Для корпоративных решений эта логика близка к тому, как проектируются долговременная память агента и RAG-контур: важна не только длина истории, но и качество сохранённого контекста.

Умные одобрения и контроль действий

Команда hermes approvals suggest формирует предложения для списка разрешений на основе истории одобрений. Операторы могут настраивать политику умных одобрений, а автоматический выключатель прекращает цикл после последовательных отказов. Улучшены также сопряжение desktop-профилей и обработка команд перенаправления демона для Docker и Podman.

Цель проста: меньше однообразных кликов «одобрить», но без снижения контроля. В автономных сценариях это не роскошь, а базовая гигиена безопасности AI-агентов.

Производительность: быстрее CLI и плавнее desktop

Кэширование промптов теперь охватывает схемы инструментов в нативном Anthropic без потери истории. Холодный старт hermes -w сократился примерно с 14 до 1,8 секунды, а операции без изменений в hermes update стали выполняться на 2–6 секунд быстрее.

Тяжёлые SDK загружаются лениво, чтение конфигурации больше не выполняет лишнее глубокое копирование, а desktop получил очередной пакет оптимизаций: стоимость стриминга не растёт вместе с длиной транскрипта, перетаскивание остаётся плавным даже при нескольких активных вкладках, фоновая нагрузка CPU в простое близка к нулю.

Новые каналы, gateway и удалённое подключение

Buzz добавлен как встроенная gateway-платформа: это мессенджер Block на базе Nostr с транспортом WebSocket и аутентификацией NIP-42. Обновлены интеграции с Vercel AI Gateway и Vercel Sandbox. Desktop-клиент получил режим подключения к удалённой серверной части по SSH.

Relay приблизился к функциональной эквивалентности: появились медиа, интерактивные запросы, управление жизненным циклом тредов, индикаторы набора текста и синхронизация личных и организационных навыков HSP.

Итог

Hermes Agent v0.20.0 — крупный релиз, в котором голос, межагентное взаимодействие, вебхуки, инструменты разработки и управление контекстом развиваются одновременно. Самые заметные темы здесь — более естественный разговор с агентом, открытая интеграция с внешними системами и повышение надёжности автономной работы. Для команд, проектирующих архитектуру AI-агентов, это хороший повод присмотреться к паттернам A2A, контролю разрешений и управляемой памяти.

Если такой агент нужен внутри компании, а не на ноутбуке разработчика, мы возьмём на себя развёртывание и сопровождение self-hosted агентов — с изолированным контуром, мониторингом и обновлениями.