ИИтак

← Назад

Модель · ByteDance

Seed 1.6 Vision

Недорогая модель ByteDance для разбора картинок и видео с рассуждениями. Устарела: её сменила линейка Seed 2.0

вышла 15 августа 2025

Характеристики

Вышла
15 августа 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
256 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 32 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,119 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,024 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$1,187 за миллион токенов
Понимает
текст, изображения
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Идентификатор в API
doubao-seed-1-6-vision-250815

Что это за модель

Seed 1.6 Vision (в китайском облаке Volcengine — Doubao-Seed-1.6-vision) — модель ByteDance для понимания изображений. Перед ответом она рассуждает. Главная особенность — визуальная цепочка рассуждений (VisualCoT). Модель может прямо во время рассуждения обработать картинку: вырезать и увеличить фрагмент, повернуть изображение, отметить на нём точку или область. Потом она смотрит на результат и рассуждает дальше. ByteDance подчёркивает, что эти инструменты встроены в саму модель, отдельные модели для них не нужны.

Модель сменила Doubao-1.5-thinking-vision-pro. По словам ByteDance, новая версия лучше понимает изображения и рассуждает о них в образовании, модерации картинок, проверках и видеонаблюдении, а также в поиске с ответами на вопросы. В материалах к запуску говорится, что она примерно вдвое дешевле предыдущего поколения. Там же заявлен лучший результат на нескольких тестах, но это оценка самой компании.

ByteDance предлагает её для сложных визуальных задач. Это понимание видео и привязка ответа к конкретному месту на картинке (grounding). Ещё один сценарий — агенты, которые управляют программами через графический интерфейс: смотрят на снимок экрана и решают, куда нажать. Режим рассуждений можно включить, выключить или отдать модели на выбор. Так разработчик сам решает, что важнее: качество ответа или скорость.

Сейчас модель устарела: в 2026 году ByteDance выпустила линейки Seed 2.0 и Seed 2.1, и они новее во всём семействе. Веса закрыты. Модель доступна только через API в облаках Volcengine и BytePlus.

Источники: Обзор модели на площадке Volcengine для разработчиков, Документация Volcengine по мультимодальным рассуждениям, Описание модели у ZenMux

Другие модели семейства

Данные: models.dev (MIT).