# Какую модель брать под задачу в Hermes Agent **Проверено: 23 сентября 2026.** Модели и тарифы меняются каждые несколько недель. Перед покупкой сверяйтесь со ссылками в конце. Таблица для тех, кто работает с [Hermes Agent](https://hermes-agent.nousresearch.com/docs). Подготовлена командой СмыслоКод (Артемий Миллер) как бесплатный материал к видео на YouTube. ## Правило выбора 1. **Думать должна сильная модель, исполнять может модель попроще.** Стратегия и планы — самой сильной, реализация по готовому плану — модели дешевле, рутина — самой дешёвой. Не надо отправлять директора за хлебом. 2. **Чем дешевле модель, тем внимательнее вы проверяете результат.** Экономия на модели оплачивается вашим временем. 3. **Сравнивайте цену готового результата, а не одного запроса.** Дешёвая модель, которая переделывает задачу три раза, в итоге обходится дороже. 4. **Не подошла модель — попробуйте другую.** У каждой свои сильные стороны и свои ограничения. Здесь нет единого победителя. ## Как читать метки - 🧑‍💼 **Личный опыт Артемия.** Так он распределяет модели в своей работе. Это практика, а не сравнительный тест и не гарантия, что у вас будет так же. - 📊 **Открытые рейтинги.** LMArena, Artificial Analysis, OpenRouter и рекомендации самих разработчиков моделей на 23.09.2026. - ⚠️ **Не подтверждено.** Мы не смогли проверить это по официальным источникам. --- ## Коротко: задача → модель | Задача | Основная | Дешевле | |---|---|---| | Стратегия и планы | GPT-6 Astra | GPT-6 Sol | | Код | Claude Fable 5.1 | Claude Opus 5.5 | | Тексты и очистка от ИИ-стиля | GPT-6 Astra | Claude Sonnet 5 | | Цифры и финансы | Claude Fable 5.1 | Claude Opus 5.5 | | Поиск и исследования | Claude Sonnet 5 | GPT-6 Luna | | Парсеры и рутина | Kimi K3 | DeepSeek Flash | | Картинки: понять | Модель с vision | Gemini 3.8 Flash | | Картинки: создать | Генератор картинок в Hermes | FLUX.2 Klein | | Служебные задачи Hermes | Дешёвая быстрая модель | Gemini free tier | | Другие модели отказались | Kimi K3 | GLM-5.3 | Подробности по каждой строке ниже. --- ## 1. Стратегия и планы - **Брать:** GPT-6 Astra — 🧑‍💼 личный опыт. 📊 Флагман OpenAI для сложных рассуждений. В индексе Artificial Analysis входит в первую тройку вместе с Claude Opus 5.5 и Claude Fable 5.1. - **Запасной вариант:** Claude Opus 5.5 или Claude Fable 5.1 — 📊. Anthropic советует Fable для самых сложных рассуждений. - **Дешевле:** GPT-6 Sol — 📊. OpenAI рекомендует Sol, когда нужен баланс качества и цены. - **Где взять:** подписка ChatGPT (у Plus лимиты на Astra небольшие, у Pro больше) или OpenAI API: Astra — $10 за 1 млн входящих токенов и $50 за 1 млн исходящих, Sol — $2 и $10. - **Как подключить в Hermes:** по подписке — провайдер **ChatGPT / Codex** (вход по коду устройства). Для оплаты по токенам — ключ OpenAI API или OpenRouter. - **Почему:** от плана зависит всё, что будет дальше. На этом шаге экономить невыгодно. ## 2. Код - **Брать:** Claude Fable 5.1 — 🧑‍💼 личный опыт («очень нравится, какой код она выдаёт»). 📊 В LMArena Agent на первом месте, в WebDev на втором после GPT-6 Astra. - **Запасной вариант:** GPT-6 Astra — 📊 первое место в LMArena WebDev. - **Дешевле:** Claude Opus 5.5 — 🧑‍💼 у Артемия Opus обходится дешевле. 📊 Anthropic советует начинать именно с него. API: $4 и $20 против $10 и $50 у Fable. - **Где взять:** Claude API или OpenRouter. В приложении Claude модель Fable на Pro доступна только за дополнительные usage credits, на Max — в пределах половины недельного лимита. Opus входит в Pro и Max. - **Как подключить в Hermes:** провайдер **Anthropic** с ключом API или **OpenRouter**. Вход по подписке Claude в Hermes работает только на тарифе Claude Max и только за счёт отдельно купленного extra usage, базовый лимит Max не тратится. Claude Pro так подключить нельзя. Сторонние шлюзы для подписки существуют, но это неофициальный путь, и Anthropic ограничивает такое использование подписки. - **Почему:** хороший код экономит часы на исправлениях. Когда план уже готов, писать по нему можно и моделью дешевле. ## 3. Тексты и очистка от ИИ-стиля - **Брать:** GPT-6 Astra — 🧑‍💼 личный опыт: хорошо убирает ИИ-шаблоны, текст начинает звучать по-человечески. - **Запасной вариант:** Claude Fable 5 / Fable 5.1 — 📊 первые места в LMArena Text, в том числе в категории Creative Writing. - **Дешевле:** Claude Sonnet 5 — 📊 по словам Anthropic, лучшее сочетание скорости и качества. API: $2 и $10. - **Где взять и как подключить:** см. разделы 1 и 2. - **Почему:** текст читает клиент. Вычитывать за дешёвой моделью обычно дольше, чем сразу взять сильную. ## 4. Анализ цифр и финансов - **Брать:** Claude Fable 5.1 — 🧑‍💼 личный опыт: глубокий разбор финансов. - **Запасной вариант:** GPT-6 Astra — 📊 в числе лидеров индекса Artificial Analysis. - **Дешевле:** Claude Opus 5.5 — 📊 первое место в LMArena Document (работа с документами). - **Где взять и как подключить:** см. раздел 2. - **Важно:** цифры всё равно перепроверяйте по первоисточнику. Финансовые и личные данные не отправляйте в бесплатные тарифы, условия которых позволяют использовать ваши данные. Например, так устроен бесплатный Gemini API. - **Почему:** ошибка в цифрах стоит дороже, чем разница в цене моделей. ## 5. Поиск и исследования - **Брать:** Claude Sonnet 5 — 🧑‍💼 личный опыт: простые задачи и поиск. - **Запасной вариант:** GPT-5.6 Sol — 📊 первое место в LMArena Search. - **Дешевле:** GPT-6 Luna — 📊 OpenAI позиционирует её для массовых простых задач. API: $0,10 и $0,50. Подойдёт и Gemini 3.8 Flash — $0,75 и $3,75, есть бесплатный тариф. - **Где взять:** Sonnet есть даже в бесплатном Claude, но в Hermes Claude подключается через API. Luna есть в Codex на всех тарифах ChatGPT, включая Free (на Free и Go доступ открывают постепенно). - **Как подключить в Hermes:** Anthropic, OpenRouter, ChatGPT / Codex или Google / Gemini (ключ из Google AI Studio). - **Почему:** для поиска важнее скорость и объём, чем глубина рассуждений. ## 6. Парсеры и рутина - **Брать:** Kimi K3 по подписке Kimi Code — 🧑‍💼 личный опыт: установка и настройка парсеров. 📊 В LMArena WebDev входит в первую десятку. - **Запасной вариант:** GLM-5.3 по подписке Z.ai (GLM Coding Plan) — 📊 Z.ai пишет, что Hermes поддерживается в режиме best-effort. - **Дешевле:** DeepSeek Flash (DeepSeek-V4.1-Flash) — 📊 официальная цена $0,15 и $0,60 в часы низкой нагрузки, в часы пик вдвое дороже. Подойдёт и GPT-6 Luna. - **Где взять:** Kimi Code входит в подписку Kimi начиная с тарифа Plus, на тарифе Go его нет. Цены — на [странице тарифов Kimi Code](https://www.kimi.com/code). DeepSeek — пополняемый баланс API. - **Как подключить в Hermes:** Kimi — провайдер **Kimi / Moonshot**, ключ создаётся в [Kimi Code Console](https://www.kimi.com/code/console). По инструкции Kimi дальше выбираете «Kimi / Kimi Coding Plan» и модель `kimi-k3`. DeepSeek — провайдер **DeepSeek** с ключом API. - **Не перепутайте:** ключ из Kimi Code Console работает по подписке. Ключ Moonshot Open Platform оплачивается за каждый запрос. - **Почему:** рутина повторяется сотни раз, поэтому цена одного прогона складывается в заметную сумму. ## 7. Работа с картинками **Понять картинку** (скриншот, фото документа, график): - **Брать:** вашу основную модель. Все модели выше, кроме DeepSeek V4 Pro и GLM-5.3, принимают изображения. 📊 В LMArena Vision первое место у Claude Fable 5. - **Дешевле:** Gemini 3.8 Flash или GPT-6 Luna. Их можно назначить отдельной вспомогательной моделью для задачи Vision (см. настройку ниже). **Создать картинку:** - **Брать:** 📊 в LMArena Text-to-Image первое место у gpt-image-2.5. В Hermes из коробки есть gpt-image-2, Nano Banana Pro (Gemini 3 Pro Image), Ideogram v3 (лучше всего справляется с надписями) и другие. - **Дешевле:** FLUX.2 Klein — модель по умолчанию в Hermes, около $0,006 за мегапиксель по ценам FAL. - **Как подключить в Hermes:** генерация идёт через FAL.ai (нужен ключ FAL) или через Tool Gateway по подписке Nous Portal. Модель выбирается командой `hermes tools`. - **Почему:** генерировать картинки умеют специальные модели, а не чат-модели. Настраиваются они отдельно. ## 8. Служебные задачи Hermes (вспомогательные модели) Кроме основной работы, Hermes постоянно выполняет фоновые мелочи: придумывает названия чатов, сжимает длинную переписку, разбирает картинки, решает, можно ли автоматически одобрить команду, и так далее. По умолчанию (`auto`) все эти задачи выполняет **ваша основная модель**. - **Брать:** дешёвую быструю модель — 🧑‍💼 личный опыт: «директора за хлебом не отправляем». 📊 Документация Hermes советует то же: сжатию и названиям чатов глубокие рассуждения не нужны. - **Варианты:** GPT-6 Luna, Gemini 3.8 Flash, DeepSeek Flash, Claude Haiku 4.5 ($1 и $5). - **Бесплатно:** у Gemini API есть бесплатный тариф с лимитами на запросы в минуту и в сутки на проект. ⚠️ На бесплатном тарифе Google может использовать ваши данные для улучшения продуктов, а сотрудники Google могут их читать. Конфиденциальное туда не отправляйте. Для ЕЭЗ, Швейцарии и Великобритании действуют условия платного тарифа. - **Где быть осторожнее:** сжатие контекста решает, что агент запомнит из длинного разговора. Слишком слабая модель здесь может потерять важное. Проверьте качество на своих задачах. - **Почему:** этих вызовов много, и платить за них ценой топовой модели невыгодно. ## 9. Задачи, от которых другие модели отказываются - **Брать:** Kimi K3 — 🧑‍💼 личный опыт. ChatGPT и Claude иногда отказываются, например, настроить парсер или собрать шлюз. С Kimi такие задачи иногда удаётся решить. - **Запасной вариант:** GLM-5.3 или DeepSeek — ⚠️ личного опыта на таких задачах нет. - **Важно:** ограничения есть у всех моделей, просто устроены по-разному. Отказ не повод обходить закон или правила сервисов. Он повод переформулировать задачу или взять другой инструмент. - **Почему:** иногда отказ связан с формулировкой или настройками модели, а не с самой задачей. --- ## Как настроить вспомогательные модели в Hermes **Hermes Desktop** (по [документации Desktop](https://hermes-agent.nousresearch.com/docs/user-guide/desktop)): 1. Откройте **Settings → Model → Auxiliary models**. 2. В строке нужной задачи (например, Compression, Title Gen, Vision) выберите провайдера и модель. 3. Рядом можно поставить глубину рассуждений: низкую, `Off` или «как у основной модели». Для частых фоновых задач обычно хватает низкой. 4. Основную модель профиля задавайте там же, в **Settings → Model**. **Веб-панель** (браузерный интерфейс). В документации написано «Show auxiliary». В текущей версии интерфейса путь такой: **Models → Model Settings → Auxiliary tasks → Configure → Change** в строке задачи. Кнопка **Reset all to auto** возвращает все задачи на основную модель. Названия кнопок могут отличаться в зависимости от версии. **Через config.yaml** (пример): ```yaml auxiliary: compression: provider: gemini model: gemini-3.8-flash title_generation: provider: gemini model: gemini-3.8-flash ``` **Проверка.** Изменения применяются к **новым** сессиям, уже открытые чаты работают на старых настройках. Если новая сессия не подхватила новый ключ или настройку, перезапустите Hermes. Провайдер должен быть подключён заранее: `auto` сам не переключится на чужой аккаунт. **Какие задачи можно перенастроить:** сжатие контекста, Vision, Web Extract, названия чатов, одобрение команд, поиск навыков, MCP, задачи Kanban, описание профилей, Curator. Полный список — в разделе [Configuring Models](https://hermes-agent.nousresearch.com/docs/user-guide/configuring-models). --- ## Где взять модели: сводка | Что | Подписка | API (за 1 млн токенов, вход / выход) | Провайдер в Hermes | |---|---|---|---| | GPT-6 Astra | ChatGPT Plus $20 (мало), Pro от $100 | $10 / $50 | ChatGPT / Codex, OpenAI, OpenRouter | | GPT-6 Sol | ChatGPT Plus и выше | $2 / $10 | те же | | GPT-6 Luna | ChatGPT Free и выше | $0,10 / $0,50 | те же | | Claude Fable 5.1 | в Hermes — только API или Max + extra usage | $10 / $50 | Anthropic, OpenRouter | | Claude Opus 5.5 | в Hermes — только API или Max + extra usage | $4 / $20 | Anthropic, OpenRouter | | Claude Sonnet 5 | в Hermes — только API или Max + extra usage | $2 / $10 | Anthropic, OpenRouter | | Claude Haiku 4.5 | в Hermes — только API или Max + extra usage | $1 / $5 | Anthropic, OpenRouter | | Kimi K3 | Kimi Code, тариф Plus и выше | через OpenRouter, цена на странице модели | Kimi / Moonshot, OpenRouter | | GLM-5.3 | GLM Coding Plan от $18 в месяц | ⚠️ смотрите на docs.z.ai | z.ai / GLM, OpenRouter | | DeepSeek Flash | — | $0,15 / $0,60 (вне пика) | DeepSeek, OpenRouter | | Gemini 3.8 Flash | — (подписки Google в Hermes не подключаются) | бесплатно с лимитами или $0,75 / $3,75 | Google / Gemini, OpenRouter | Цены взяты с официальных страниц на 23.09.2026, без налогов. У Gemini 3.8 Flash цена вырастет с 1 января 2027 года. Если подключаться через OpenRouter, цена может отличаться. Есть и другой вариант — **Nous Portal**, подписка от создателей Hermes. Один вход даёт доступ к сотням моделей и к Tool Gateway (поиск, картинки, голос). Подробности — на [странице Nous Portal](https://hermes-agent.nousresearch.com/docs/integrations/providers). --- ## Что мы не подтвердили ⚠️ - Как именно запросы из Hermes расходуют лимиты подписки ChatGPT, в документации Hermes не описано. - GPT-6 Sol и GPT-6 Luna вышли 22.09.2026. Если их ещё нет в списке моделей ChatGPT / Codex в вашем Hermes, возьмите GPT-5.6 Sol или GPT-5.6 Luna. - Точные цены тарифов Kimi Code по странам: их страница загружается динамически, и мы не смогли её прочитать. Смотрите сами на kimi.com/code. - Цены тарифов GLM Coding Plan выше стартового. - Как модели справляются с задачами из раздела 9, кроме Kimi. Здесь нет ни личного опыта, ни открытых тестов. - Никаких процентов экономии здесь нет: мы их не измеряли. Сколько вы сэкономите, зависит от ваших задач и выбранных моделей. ## Источники - Hermes: [AI Providers](https://hermes-agent.nousresearch.com/docs/integrations/providers) · [Configuring Models](https://hermes-agent.nousresearch.com/docs/user-guide/configuring-models) · [Desktop](https://hermes-agent.nousresearch.com/docs/user-guide/desktop) · [Configuration](https://hermes-agent.nousresearch.com/docs/user-guide/configuration) · [Image Generation](https://hermes-agent.nousresearch.com/docs/user-guide/features/image-generation) - OpenAI: [Models](https://developers.openai.com/api/docs/models) · [Codex pricing](https://developers.openai.com/codex/pricing) - Anthropic: [Models overview](https://docs.anthropic.com/en/docs/about-claude/models/overview) · [Claude pricing](https://claude.com/pricing) - Kimi: [Kimi в Hermes Agent](https://www.kimi.com/code/docs/en/third-party-tools/hermes.html) · [Membership Benefits](https://www.kimi.com/code/docs/en/kimi-code/membership.html) · [Kimi K3 на OpenRouter](https://openrouter.ai/moonshotai/kimi-k3) - Google: [Gemini models](https://ai.google.dev/gemini-api/docs/models) · [Pricing](https://ai.google.dev/gemini-api/docs/pricing) · [Terms](https://ai.google.dev/gemini-api/terms) - DeepSeek: [Models & Pricing](https://api-docs.deepseek.com/quick_start/pricing) - Z.ai: [GLM Coding Plan](https://docs.z.ai/devpack/overview) · [Other tools](https://docs.z.ai/devpack/tool/others) - Рейтинги: [LMArena](https://lmarena.ai/leaderboard) · [Artificial Analysis](https://artificialanalysis.ai/leaderboards/models) · [OpenRouter Rankings](https://openrouter.ai/rankings) (данные OpenRouter — CC BY 4.0) --- Нашли устаревшее? Откройте issue в этом репозитории.