Модель · Google
Gemini 2.5 Flash-Lite
Бюджетная модель Google линейки 2.5 для перевода, классификации и массовых простых задач, устаревшая после выхода Gemini 3.5 Flash Lite
вышла 17 июня 2025
Характеристики
- Вышла
- 17 июня 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 65 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,10 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,01 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0,40 за миллион токенов
- Понимает
- текст, изображения, аудио, видео, PDF
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- январь 2025
- Идентификатор в API
- gemini-2.5-flash-lite
Что это за модель
Gemini 2.5 Flash-Lite — самая дешёвая и быстрая модель в линейке Gemini 2.5. Google представила её как вариант для больших объёмов запросов, где важны низкая цена и быстрый ответ. Компания описывает её задачу как лучший «интеллект на доллар». Модель принимает текст, картинки, звук, видео и PDF, а отвечает текстом.
По замерам Google, Flash-Lite превосходит предыдущую Gemini 2.0 Flash-Lite в бенчмарках по программированию, математике, естественным наукам, рассуждениям и работе с разными типами данных. По словам компании, на широком круге запросов она отвечает с меньшей задержкой, чем 2.0 Flash-Lite и 2.0 Flash. От старшей Gemini 2.5 Flash она отличается тем, что жертвует частью качества ради скорости и цены. Рассуждения перед ответом можно включать и задавать для них бюджет, то есть предел числа токенов, которые модель потратит на размышления.
Google советует брать её для массовых задач, где важна скорость: перевода, классификации, разбора документов и видео. Модель может сама искать в Google Search, чтобы опираться на свежие источники, и запускать код. Среди клиентов компания называет HeyGen: сервис переводит с её помощью видео на 180 языков. Её особые версии Google использует и в своём поиске.
Это лёгкая модель, поэтому на сложных задачах она уступает Gemini 2.5 Flash и Pro. Сейчас её потеснили модели Google новых поколений, в том числе Gemini 3.5 Flash Lite из того же ценового класса.
Источники: Анонс линейки Gemini 2.5 с Flash-Lite, Стабильная версия Gemini 2.5 Flash-Lite
Другие модели семейства
-
Gemini 3.5 Flash Lite
Google77-е место в Epochконтекст 1 млн$0,30 / $2,50рассуждения
-
Nano Banana 2 Lite
Googleконтекст 65 тыс.$0,25 / $30рассуждения
-
Gemini 3.1 Flash Lite
Google80-е место в Epochконтекст 1 млн$0,25 / $1,50рассуждения
Данные: models.dev (MIT).