Модель · Google
Nano Banana Pro
Старшая модель Google для генерации и правки картинок: сложные композиции, читаемый текст на изображениях, качество до 4K
вышла 28 мая
Характеристики
- Вышла
- 28 мая
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 131 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 32 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $2 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $120 за миллион токенов
- Понимает
- текст, изображения
- Отвечает
- текст, изображения
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- нет
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- январь 2025
- Идентификатор в API
- gemini-3-pro-image
Что это за модель
Nano Banana Pro, в API она называется Gemini 3 Pro Image, — модель Google DeepMind, которая рисует и редактирует изображения. Она построена на языковой модели Gemini 3 Pro и перед ответом рассуждает: разбирает сложный запрос и может сделать промежуточные пробные картинки, прежде чем выдать итоговую. Впервые Google показала её в ноябре 2025 года. Общий доступ для разработчиков и корпоративных клиентов открылся в конце мая 2026 года, одновременно с Nano Banana 2.
В линейке Nano Banana это старшая модель. По словам Google, исходную Nano Banana стоит брать для быстрых и простых правок, а Pro — для сложных композиций, где важно наивысшее качество. Nano Banana 2 (Gemini 3.1 Flash Image) быстрее и экономнее, а Pro компания советует, когда качество картинки важнее скорости. Кроме того, только Nano Banana 2 умеет делать картинку по видео.
Главная сила модели — точность. Она пишет на картинках разборчивый текст на разных языках и разными шрифтами. Поэтому её берут для инфографики, схем, плакатов, слайдов и рекламных макетов. По анонсу, она объединяет в одной сцене до 14 исходных картинок и сохраняет узнаваемость до пяти человек. Ещё она позволяет править отдельные участки изображения и менять ракурс, глубину резкости, цвет и освещение, например превратить день в ночь. Она умеет выдавать вперемешку текст и иллюстрации, например пошаговую инструкцию с картинками.
Каждая картинка получает невидимый водяной знак SynthID, по которому Google может определить, что изображение сделано нейросетью. В приложении Gemini у бесплатных пользователей и подписчиков Pro на картинках есть и видимый значок, его убирают только в подписке Ultra. Бесплатные пользователи получают ограниченное число генераций, а потом приложение переключает их на обычную Nano Banana. Разрешение 4K в корпоративной платформе Google на момент общего доступа ещё оставалось предварительной версией.
Источники: Анонс Nano Banana Pro в блоге Google, Документация Gemini API: генерация изображений, Общий доступ к Nano Banana 2 и Nano Banana Pro
Другие модели семейства
-
Gemini 3.5 Live Translate Preview
Googleконтекст 16 тыс.$3,50 / $21
-
Deep Research Max Preview
Googleконтекст 131 тыс.$2 / $12рассуждения
-
Deep Research Preview
Googleконтекст 131 тыс.$2 / $12рассуждения
-
Gemini 3.1 Pro Preview
Google27-е место в Epochконтекст 1 млн$2 / $12рассуждения
-
Gemini 3.1 Pro Preview Custom Tools
Google27-е место в Epochконтекст 1 млн$2 / $12рассуждения
-
Gemini 2.5 Computer Use Preview 10-2025
Googleконтекст 131 тыс.$1,25 / $10рассуждения
-
Gemini 2.5 Pro
Google76-е место в Epochконтекст 1 млн$1,25 / $10рассуждения
Новости о модели
- 01
Данные: models.dev (MIT).