ИИтак

← Назад

Модель · Google

Gemini 2.5 Flash-Lite

Бюджетная модель Google линейки 2.5 для перевода, классификации и массовых простых задач, устаревшая после выхода Gemini 3.5 Flash Lite

вышла 17 июня 2025

Характеристики

Вышла
17 июня 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,10 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,01 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$0,40 за миллион токенов
Понимает
текст, изображения, аудио, видео, PDF
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
январь 2025
Идентификатор в API
gemini-2.5-flash-lite

Что это за модель

Gemini 2.5 Flash-Lite — самая дешёвая и быстрая модель в линейке Gemini 2.5. Google представила её как вариант для больших объёмов запросов, где важны низкая цена и быстрый ответ. Компания описывает её задачу как лучший «интеллект на доллар». Модель принимает текст, картинки, звук, видео и PDF, а отвечает текстом.

По замерам Google, Flash-Lite превосходит предыдущую Gemini 2.0 Flash-Lite в бенчмарках по программированию, математике, естественным наукам, рассуждениям и работе с разными типами данных. По словам компании, на широком круге запросов она отвечает с меньшей задержкой, чем 2.0 Flash-Lite и 2.0 Flash. От старшей Gemini 2.5 Flash она отличается тем, что жертвует частью качества ради скорости и цены. Рассуждения перед ответом можно включать и задавать для них бюджет, то есть предел числа токенов, которые модель потратит на размышления.

Google советует брать её для массовых задач, где важна скорость: перевода, классификации, разбора документов и видео. Модель может сама искать в Google Search, чтобы опираться на свежие источники, и запускать код. Среди клиентов компания называет HeyGen: сервис переводит с её помощью видео на 180 языков. Её особые версии Google использует и в своём поиске.

Это лёгкая модель, поэтому на сложных задачах она уступает Gemini 2.5 Flash и Pro. Сейчас её потеснили модели Google новых поколений, в том числе Gemini 3.5 Flash Lite из того же ценового класса.

Источники: Анонс линейки Gemini 2.5 с Flash-Lite, Стабильная версия Gemini 2.5 Flash-Lite

Другие модели семейства

Данные: models.dev (MIT).