Гибриды в облачных агентах: одна модель на задачу и своя — у каждого субагента
Гибриды — одна модель из двух ваших, сильной и быстрой, — теперь работают и в
облачных агентах. Выберите гибрид моделью агента: в консоли он есть в списке моделей в
дополнительных настройках, в Telegram-боте — в /model. Дальше гибрид сам решает, какой модели
отдать работу.
Почему агенту нужно другое правило
В чате гибрид решает на каждое сообщение: каждое оценивается отдельно, и модели могут чередоваться. Агенту так нельзя. На одну задачу он отправляет десятки запросов — каждый результат команды возвращается к модели отдельным запросом, — и каждый следующий шаг опирается на всё, что было до него. Если сменить модель посреди такой работы:
- Кэш промпта пропадёт. Он привязан к модели, а у агента в контексте легко 100 тысяч токенов и больше. Каждое переключение оплачивало бы их заново, и экономия ушла бы на это.
- Модель получит чужие рассуждения. В истории агента лежат блоки рассуждений, подписанные той моделью, которая их написала. Другая модель может такую историю просто не принять.
Поэтому агенту гибрид выбирает модель один раз на разговор — по задаче, с которой разговор начался. Дальше разговор до конца идёт на этой модели, включая ваши уточнения по ходу работы.
Основной агент и субагенты
Основной агент работает над вашей задачей: «перепиши модуль авторизации на OAuth2» уйдёт сильной модели, и вся сессия пройдёт на ней.
Но агент часто запускает субагентов — поручить поиск по коду, разбор логов, проверку гипотезы. Каждый субагент на основной модели — отдельный разговор, и гибрид решает за него отдельно, по его собственному поручению. «Найди все тесты модуля авторизации» уйдёт быстрой модели, хотя основная работа идёт на сильной. Именно здесь у агентов основная экономия: самое объёмное и простое делается дёшево, а сложное остаётся на сильной модели.
Решение воспроизводимо: тот же разговор получит тот же ответ, даже если мы перезапустили сервис посреди сессии.
Как гибрид узнаёт агента
По инструментам. Агент в каждом запросе передаёт описание своих инструментов — чтения файлов,
команд, поиска, — а чат не передаёт. Поэтому правило работает не только в облачных агентах, но и
с вашим собственным Claude Code, Codex или Cline, подключёнными через API: укажите
hybrid/<название> как модель.
Единственное исключение — картинки
Если в разговоре появилось изображение — например, агент открыл скриншот, — а выбранная модель картинки не читает, разговор переходит к той модели гибрида, что читает. Иначе каждый следующий запрос заканчивался бы ошибкой. Это единственный случай, когда модель меняется посреди разговора.
Какой гибрид подойдёт агенту
Обе модели гибрида должны быть из тех, что допущены к агентам: агент без надёжного вызова инструментов зря тратит оплаченную машину. В консоли и в боте агенту показываются только такие гибриды. Хорошая пара для начала — Claude Sonnet 5.5 сильной моделью и DeepSeek V4 Flash 0731 быстрой.
Фоновая модель агента — для коротких служебных запросов — остаётся обычной: оценивать каждый такой запрос стоило бы дороже, чем он сам.
Цены и результат
Вы платите за модель, которая ответила, по её цене, плюс одно решение Jev на разговор — около 0,002 кредита. Сессия агента на двести запросов с тремя субагентами — это четыре решения, а не двести.
Расход агентов попадает в статистику гибрида вместе с чатом: экономия по сравнению с одной сильной моделью и доля ответов быстрой модели — на странице «Гибриды» в консоли.
Удачной разработки!