Hermes Agent 0.18.0: открытый ИИ-агент научился проверять сам себя

Nous Research известна открытыми моделями серии Hermes и репутацией команды, которая делает всё в публичном репозитории. Hermes Agent - их агент для работы с кодом и задачами, с тегом «агент, который растёт вместе с вами». Версия 0.18.0 - крупнейшее обновление за историю проекта.
Почти тысяча правок за релиз
За обновлением стоит около 1720 коммитов и 998 принятых правок (merged PR) от более чем 370 контрибьюторов. Отдельная цифра, которой команда гордится: закрыты все критические (P0) и высокоприоритетные (P1) задачи в репозитории - около 700 штук за полторы недели. На момент релиза открытых P0/P1 не осталось ни одной, и команда обещает держать этот ноль дальше.
Для открытого проекта, который люди запускают в реальной работе, это важнее любой новой функции. Предсказуемость и отсутствие известных критических багов - то, чего обычно не хватает быстрорастущим агентам.
Комитет моделей как одна модель
Самое заметное нововведение - Mixture-of-Agents (MoA) стал полноценной выбираемой моделью. Раньше это был отдельный режим; теперь именованные ансамбли (например, «my-council») стоят в списке наравне с Claude, GPT или Grok. Выбрал ансамбль - Hermes сам прогоняет запрос через все входящие в него модели.
Пользователь видит полные цепочки рассуждений каждой модели, а итоговый, собранный ответ стримится в реальном времени. «Совет» из frontier-моделей перестаёт быть чёрным ящиком. Обратная сторона очевидна: гонять запрос через несколько моделей сразу - дороже и медленнее, чем спросить одну. Инструмент под сложные задачи, а не под каждый чих.
Агент собирает доказательства, а не верит себе
Ключевая идея «Judgement Release» - агент перестаёт полагаться только на собственную оценку «я всё сделал». Теперь Hermes собирает доказательства завершения: например, запускает тесты проекта и смотрит на результат. Команда /goal получила completion contracts - явные критерии готовности, по которым агент судит о результате.
Это прямой ответ на главную боль автономных агентов - уверенные рапорты об успехе там, где задача не доделана. Насколько честно работает самопроверка на практике, покажут только пользовательские сценарии, но направление выбрано верное.
Память стала редактируемым графом
Два обновления меняют работу с обучением. Команда /learn превращает любой опыт - папку, ссылку, недавний рабочий процесс - в переиспользуемый навык (skill), который агент сохраняет по стандартам проекта. А /journey вместе с Memory Graph показывает всё, что агент узнал о пользователе: таймлайн воспоминаний и навыков, доступный в консоли, TUI и десктоп-приложении.
Главное здесь - граф можно редактировать и чистить. Память агента перестаёт быть непрозрачным хранилищем, куда что-то попадает без контроля пользователя.
Фоновые субагенты и десктоп-Проекты
Субагенты теперь запускаются в фоне: можно поручить параллельный анализ нескольких объектов, чат при этом не блокируется, а в конце приходит сводка. Десктоп-приложение получило раздел Projects - боковую панель с кодовыми базами, панель обзора и управление git worktree. Для разработчиков Hermes подтягивается к формату полноценной рабочей станции.
В списке помельче - масштабирование gateway до нуля при простое, удешевлённое самообучение на лёгкой фоновой модели, поддержка Google Vertex AI для Gemini, открытие системного промпта в редакторе через /prompt и интеграция с Krea.
Проверочная точка - ноль багов
Обновление ставится командой hermes update, полные release notes лежат на GitHub. Релиз читается как заявка на то, чего рынку агентов не хватает больше всего: не новых трюков, а проверяемого результата и прозрачной, управляемой памяти. Проверочная точка простая - удержит ли команда обещанный ноль по критическим задачам через пару следующих релизов. Если да, Hermes станет редким примером открытого агента, которому можно доверить реальную работу без постоянного надзора.