Генерация изображений: модели Gemini Image на Kodagent

В каталоге Kodagent появились первые модели, генерирующие изображения: Gemini 3.1 Flash Image и Gemini 3 Pro Image от Google (семейство «Nano Banana»). До сих пор все модели каталога умели картинки только читать — эти две умеют их создавать и редактировать.

Что внутри

  • Текст → картинка: опишите, что нужно, — изображение придёт прямо в ответе чата.
  • Редактирование: прикрепите фото (обе модели принимают изображения на вход) и попросите изменить — модель вернёт отредактированную версию.
  • Два уровня: Flash — скорость и цена, Pro — максимальное качество; у Pro есть кэширование промптов для итеративных сессий редактирования.

Цены

Цены за 1M токенов, списываются с баланса кредитов (1 кредит = $0.01; при курсе по умолчанию 1 кредит = 1 ₽). Сгенерированные изображения тарифицируются токенами изображений по отдельной ставке — стандартная картинка 1024×1024 — это 1 290 токенов:

Gemini 3.1 Flash ImageGemini 3 Pro Image
Вход$0.50 / 50 кредитов$2.00 / 200 кредитов
Текстовый вывод$3.00 / 300 кредитов$12.00 / 1 200 кредитов
Вывод изображений$60 / 6 000 кредитов$120 / 12 000 кредитов
≈ за картинку~8 ₽~15 ₽

Как использовать

Проще всего — чат в консоли: выберите gemini-3.1-flash-image или gemini-3-pro-image, опишите картинку (или прикрепите свою для редактирования) — результат появится прямо в ответе, по клику откроется в полном размере.

Через OpenAI-совместимый API достаточно добавить modalities к обычному chat completion:

curl https://kodagent.ru/api/llm/v1/chat/completions \
  -H "Authorization: Bearer $KODAGENT_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-image",
    "modalities": ["image", "text"],
    "messages": [{"role": "user", "content": "Пиксель-арт: рыжая лиса, 16x16"}]
  }'

Сгенерированные изображения возвращаются в массиве images сообщения ассистента как data-URL.

Удачных генераций!

Генерация изображений: модели Gemini Image на Kodagent — Kodagent