Kimi K3 теперь доступна на Kodagent
Kimi K3 от Moonshot AI — их новый флагман, сверхбольшая открытая мультимодальная рассуждающая модель — появилась в каталоге Kodagent. Она продолжает линейку суперпопулярного семейства K2: создана для сложного кодинга, работы со знаниями и долгих агентных сессий и особенно сильна в навигации по большим кодовым базам.
Что внутри
- Контекст 1M токенов — полный миллион, как у GLM-5.2.
- Мультимодальный ввод: текст и изображения — модель читает скриншоты, диаграммы и макеты интерфейсов.
- Встроенные размышления (reasoning) с настраиваемой глубиной — модель думает, прежде чем отвечать.
- Открытые веса; обслуживается собственным эндпоинтом Moonshot AI.
Цены
Цены за 1M токенов, списываются с баланса кредитов (1 кредит = $0.01; при курсе по умолчанию 1 кредит = 1 ₽):
| USD / 1M | Кредиты / 1M | |
|---|---|---|
| Вход | $3.00 | 300 |
| Выход | $15.00 | 1 500 |
| Чтение кэша | $0.30 | 30 |
Чтение кэша тарифицируется в десять раз дешевле обычного входа — а кодинг-агенты пересылают почти весь контекст с каждым запросом, так что основная часть типичной сессии идёт по кэшной цене. Запись кэша без наценки: тарифицируется по обычной цене входа.
Как использовать
Слаг модели — kimi-k3. Она работает во всех режимах шлюза: OpenAI-совместимый Chat
Completions, Responses API (Codex) и Anthropic Messages API (Claude Code):
export ANTHROPIC_BASE_URL="https://kodagent.ru/api/llm"
export ANTHROPIC_AUTH_TOKEN="<ваш-api-ключ>"
export ANTHROPIC_MODEL="kimi-k3"
claude
Готовые конфиги для каждого агента — с уже подставленным ключом — есть на странице API-ключей в консоли; подробный разбор — в гайде по подключению.
А где fast-версия?
Пока нет. У Kimi K2 и K2.7 Code есть fast-варианты с закреплённым провайдером
(kimi-k2-fast на Groq, kimi-k2.7-code-fast на высокоскоростном тарифе Moonshot), но K3
сейчас обслуживается единственным стандартным эндпоинтом — закреплять нечего. Как только
появится высокоскоростной эндпоинт, добавим kimi-k3-fast.
Удачной работы!