Генерация изображений: модели Gemini Image на Kodagent
В каталоге Kodagent появились первые модели, генерирующие изображения: Gemini 3.1 Flash Image и Gemini 3 Pro Image от Google (семейство «Nano Banana»). До сих пор все модели каталога умели картинки только читать — эти две умеют их создавать и редактировать.
Что внутри
- Текст → картинка: опишите, что нужно, — изображение придёт прямо в ответе чата.
- Редактирование: прикрепите фото (обе модели принимают изображения на вход) и попросите изменить — модель вернёт отредактированную версию.
- Два уровня: Flash — скорость и цена, Pro — максимальное качество; у Pro есть кэширование промптов для итеративных сессий редактирования.
Цены
Цены за 1M токенов, списываются с баланса кредитов (1 кредит = $0.01; при курсе по умолчанию 1 кредит = 1 ₽). Сгенерированные изображения тарифицируются токенами изображений по отдельной ставке — стандартная картинка 1024×1024 — это 1 290 токенов:
| Gemini 3.1 Flash Image | Gemini 3 Pro Image | |
|---|---|---|
| Вход | $0.50 / 50 кредитов | $2.00 / 200 кредитов |
| Текстовый вывод | $3.00 / 300 кредитов | $12.00 / 1 200 кредитов |
| Вывод изображений | $60 / 6 000 кредитов | $120 / 12 000 кредитов |
| ≈ за картинку | ~8 ₽ | ~15 ₽ |
Как использовать
Проще всего — чат в консоли: выберите gemini-3.1-flash-image или
gemini-3-pro-image, опишите картинку (или прикрепите свою для редактирования) — результат
появится прямо в ответе, по клику откроется в полном размере.
Через OpenAI-совместимый API достаточно добавить modalities к обычному chat completion:
curl https://kodagent.ru/api/llm/v1/chat/completions \
-H "Authorization: Bearer $KODAGENT_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-image",
"modalities": ["image", "text"],
"messages": [{"role": "user", "content": "Пиксель-арт: рыжая лиса, 16x16"}]
}'
Сгенерированные изображения возвращаются в массиве images сообщения ассистента как data-URL.
Удачных генераций!