Большинство ИИ-агентов начинают каждый понедельник с амнезии. Они могут помнить разговор, но не обязательно превращают с трудом найденный на прошлой неделе рабочий прием в надежную процедуру. Hermes Agent обещает нечто более интересное: если процесс оказался удачным, агент может сохранить урок как читаемый навык, позже вспомнить подходящий опыт и показать растущую память для проверки. Это скорее не гениальный временный сотрудник, а мастерская тетрадь, которая становится лучше организована после каждого проекта.
Такой цикл обучения остается главной особенностью Hermes. /learn превращает процесс, каталог или источник в повторно используемое процедурное знание; /journey показывает связи между воспоминаниями; настольное приложение представляет историю как редактируемый граф. Для программирования /goal добавляет вторую дисциплину: прежде чем праздновать победу, агенту можно потребовать доказательство, например успешный запуск тестов проекта. Это не делает каждый ответ правильным, зато слово «готово» означает нечто большее, чем уверенно написанное заключение.
Версия 0.20, релиз Herald, не заменяет эту идею. Она делает цикл агента менее расточительным. Nous сообщает, что они изучили 250 000 разговоров Hermes вместе с NVIDIA Nemo Relay и обнаружили, что дорогостоящий сбой часто кроется не в гигантском промпте, а в небольшой утечке, повторяющейся много ходов подряд: громоздкие схемы, больше не нужный вывод инструментов, патч, который почти совпадает, или поиск, который сдается на одну букву раньше времени. Herald урезает схемы, удаляет устаревший вывод инструментов, постепенно сжимает контекст, сохраняет недавние сообщения пользователя и дает инструментам способы восстановиться до того, как модель изобретет новый план. Это особенно важно, когда используется небольшая локальная модель, у которой меньше возможностей справляться с беспорядочным рабочим процессом.
Самое существенное изменение состоит в том, что инструменты теперь помогают исправлять их собственные обычные ошибки. Усеченный результат терминала сохраняется в файл, а не становится слепым пятном. patch знает, как объяснить уже примененное изменение или несовпадение пробелов. Запись проверяется на диске. Поиск без результатов ищет частичные совпадения. А лимит по умолчанию для вызова инструментов увеличивается с 90 до 500, так что длинная задача с меньшей вероятностью остановится из-за произвольного счетчика. Ничто из этого не делает Hermes безошибочным; это просто убирает знакомые механические ошибки с пути модели. Именно такое улучшение может превратить слабую модель из “почти полезной” в рабочего помощника.
Безопасность тоже движется в разумную сторону. Hermes может получать секреты из Bitwarden и 1Password, уменьшая потребность в огромном открытом файле окружения. Явные шаблоны запрета блокируют выбранные команды даже при ослаблении других проверок. Сужение области учетных данных, редактирование вывода, общие проверки доступа к файлам и ограничения размера запросов закрывают дополнительные пробелы. Но новый режим «умного подтверждения» следует описывать аккуратно: вторая языковая модель оценивает отмеченную команду и может разрешить ее автоматически. Это снижает усталость от диалогов подтверждения, однако модель, проверяющая модель, — не sandbox и не граница прав операционной системы.
С Herald Hermes также ощущается меньше как консольный эксперимент и больше как коллега, к которому можно обратиться в нужном месте. Добавлен потоковый разговорный голос, который можно естественно перебить, локальные слова-активаторы (wake words), Agent-to-Agent v1.0, подписанные вебхуки, обоснованный поиск с цитатами, которые проверяются по исходному тексту, настольные артефакты и плагины, а также возможность перенаправить активный ход вместо того, чтобы останавливать и начинать все заново. Новые команды исключительно практичны: !command позволяет не тратить ход модели на действие в оболочке, /context показывает, чем заполнено окно, а /diff показывает, что изменилось. Импортеры для Claude Code и Codex снижают стоимость тестирования Hermes параллельно с уже существующей настройкой.
Вывод остается намеренно сдержанным. Herald — это значительный скачок в возможностях, потому что он делает те же амбиции агента дешевле, менее хрупкими и более управляемыми — особенно с такой моделью, как DeepSeek V4 Flash 0731 или другим локальным эндпоинтом. Мы повышаем оценку Hermes до 8,5, но сохраняем второе место: Nous предоставила необычайно подробную информацию о разработке релиза, а не независимое сравнение использования токенов, задержки и успеха выполнения задач. Выбирайте Hermes, если проверяемое самообучение, подтверждаемые цели в коде, свобода выбора локальных моделей и сложное делегирование стоят эксплуатационных усилий. Если вам нужен готовый сервис, где один поставщик отвечает за каждое разрешение и каждый сбой, Hermes по-прежнему требует от владельца слишком многого.