ИИтак

← Назад

Модель · Google

Nano Banana Pro

Старшая модель Google для генерации и правки картинок: сложные композиции, читаемый текст на изображениях, качество до 4K

вышла 28 мая

Характеристики

Вышла
28 мая
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
131 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 32 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$2 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$120 за миллион токенов
Понимает
текст, изображения
Отвечает
текст, изображения
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
нет
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
январь 2025
Идентификатор в API
gemini-3-pro-image

Что это за модель

Nano Banana Pro, в API она называется Gemini 3 Pro Image, — модель Google DeepMind, которая рисует и редактирует изображения. Она построена на языковой модели Gemini 3 Pro и перед ответом рассуждает: разбирает сложный запрос и может сделать промежуточные пробные картинки, прежде чем выдать итоговую. Впервые Google показала её в ноябре 2025 года. Общий доступ для разработчиков и корпоративных клиентов открылся в конце мая 2026 года, одновременно с Nano Banana 2.

В линейке Nano Banana это старшая модель. По словам Google, исходную Nano Banana стоит брать для быстрых и простых правок, а Pro — для сложных композиций, где важно наивысшее качество. Nano Banana 2 (Gemini 3.1 Flash Image) быстрее и экономнее, а Pro компания советует, когда качество картинки важнее скорости. Кроме того, только Nano Banana 2 умеет делать картинку по видео.

Главная сила модели — точность. Она пишет на картинках разборчивый текст на разных языках и разными шрифтами. Поэтому её берут для инфографики, схем, плакатов, слайдов и рекламных макетов. По анонсу, она объединяет в одной сцене до 14 исходных картинок и сохраняет узнаваемость до пяти человек. Ещё она позволяет править отдельные участки изображения и менять ракурс, глубину резкости, цвет и освещение, например превратить день в ночь. Она умеет выдавать вперемешку текст и иллюстрации, например пошаговую инструкцию с картинками.

Каждая картинка получает невидимый водяной знак SynthID, по которому Google может определить, что изображение сделано нейросетью. В приложении Gemini у бесплатных пользователей и подписчиков Pro на картинках есть и видимый значок, его убирают только в подписке Ultra. Бесплатные пользователи получают ограниченное число генераций, а потом приложение переключает их на обычную Nano Banana. Разрешение 4K в корпоративной платформе Google на момент общего доступа ещё оставалось предварительной версией.

Источники: Анонс Nano Banana Pro в блоге Google, Документация Gemini API: генерация изображений, Общий доступ к Nano Banana 2 и Nano Banana Pro

Другие модели семейства

Новости о модели

  1. 01

    Google выпустила Google Pics — ИИ-редактор картинок прямо в Docs и Slides

    Google AI

все 1 новость о Nano Banana Pro →

Данные: models.dev (MIT).