Гибриды: сильная модель — только там, где она нужна
Большая часть запросов к ИИ — простые: переименовать переменную, перевести фразу, объяснить ошибку в одну строку. Сильная модель отвечает на них так же хорошо, как быстрая, но в десятки раз дороже. А выбирать модель вручную перед каждым сообщением никто не станет.
Сегодня в Kodagent появились гибриды: одна модель из двух ваших — сильной для сложного и быстрой для простого. Перед каждым ходом модель решений Jev оценивает запрос и отправляет его той, что нужна. В чате и в API гибрид выглядит как обычная модель, менять код не нужно.
Как гибрид решает
Jev — модель решений от TypeSafe: она не пишет текст, а отвечает на вопрос числом. Гибрид спрашивает её, нужна ли запросу сильная модель, и получает вероятность от 0 до 1. Если она не ниже порога (по умолчанию 0,5), запрос уходит сильной модели, иначе — быстрой.
Прежде чем включать гибриды, мы проверили Jev на 80 размеченных запросах — 40 пар на русском и английском, от «Привет!» до «докажи, что простых чисел вида 4k+3 бесконечно много». С выбранной формулировкой вопроса каждый сложный запрос получил не меньше 0,79, а каждый простой — не больше 0,09. При пороге 0,5 ошибок не было ни на русском, ни на английском, а повторный запрос давал то же число. Решение занимает около 0,7 секунды и стоит около 0,002 кредита.
Кроме оценки Jev, гибрид учитывает ещё три правила:
- Картинки. Если в запросе изображение, а читать его умеет только одна из двух моделей, запрос уйдёт ей — что бы ни сказала Jev.
- Ваш выбор. Кнопка «Ответить сильной моделью» в чате или заголовок
X-Kodagent-Route: strongв API отправляют ход сильной модели без вопросов. - Надёжность. Если Jev не ответила за 4 секунды, ход уходит сильной модели: гибрид, который не смог решить, выбирает качество, а не экономию.
Сообщение в чате, разговор у агента
В чате гибрид решает на каждое новое сообщение. Агент для программирования устроен иначе: на одну задачу он отправляет десятки запросов, и переключать модели между ними нельзя — пропал бы кэш промпта и цепочка рассуждений. Поэтому агенту гибрид выбирает модель один раз на весь разговор, по задаче, а каждый субагент получает своё решение. Как это устроено, рассказываем в отдельной статье.
Как создать
- В консоли откройте «Гибриды» и нажмите «Создать гибрид».
- Задайте название, сильную модель (например, Claude Sonnet 5.5), быструю (например, DeepSeek V4 Flash) и порог.
- Выберите гибрид в чате — он в группе «Гибриды» в списке моделей — или укажите
hybrid/<название>как модель в API:
curl https://kodagent.ru/api/llm/v1/chat/completions \
-H "Authorization: Bearer <ваш-api-ключ>" \
-H "Content-Type: application/json" \
-d '{
"model": "hybrid/coding",
"messages": [{"role": "user", "content": "Переименуй переменную tmp в userCount"}]
}'
Гибрид работает на всех полосах шлюза — Chat Completions, Responses и Anthropic Messages — и
появляется в /v1/models. Какая модель ответила и почему, видно в заголовках ответа:
X-Kodagent-Model, X-Kodagent-Route и X-Kodagent-Route-Score. В чате то же самое написано
прямо у ответа: «ответила DeepSeek V4 Flash».
Как понять, что он работает
На странице гибрида — цифры за 30 дней:
- Экономия — сколько вы потратили по сравнению с тем же объёмом на одной сильной модели, уже за вычетом стоимости решений Jev. Это оценка: мы берём те же токены по ценам сильной модели.
- Доля ответов быстрой модели и раскладка по моделям.
- Эскалации — доля ходов, где вы попросили ответ сильной модели вручную. Это и есть промахи гибрида: если эскалаций много, выберите быструю модель посильнее или понизьте порог.
- Решения Jev — сколько их было, сколько они длились и стоили.
Цены
Наценки за гибрид нет. Вы платите за модель, которая ответила, по её обычной цене, плюс решение Jev — 5 кредитов за 1M входных токенов, около 0,002 кредита за ход. Продолжения хода решения не требуют и ничего лишнего не стоят.
В облачных агентах
Гибрид можно выбрать и моделью облачного агента — в консоли или командой /model в
Telegram-боте, — и подключить к своему Claude Code, Codex или Cline через API. Подробности — в
статье «Гибриды в облачных агентах».
Удачной разработки!