Модель · StepFun
Step 3.5 Flash 2603
Бюджетная модель StepFun для агентов и программирования, обновление Step 3.5 Flash с экономным режимом рассуждений
вышла 2 апреля
Характеристики
- Вышла
- 2 апреля
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 256 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 256 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,10 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,02 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0,30 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Знания до
- январь 2025
- Идентификатор в API
- step-3.5-flash-2603
Что это за модель
Step 3.5 Flash 2603 — обновлённая версия Step 3.5 Flash, основной рассуждающей модели StepFun. Устроена она как смесь экспертов (mixture of experts): внутри много узких подсетей, и на каждый токен включается лишь несколько из них. Всего в модели около 196 млрд параметров, а на каждый токен работает примерно 11 млрд. Поэтому она быстрая и дешёвая при большом размере. Чтобы длинный контекст обходился дешевле, на три слоя с «окном» внимания, где модель смотрит только на ближайший текст, приходится один слой полного внимания. Модель также предсказывает сразу несколько токенов за шаг.
От исходной Step 3.5 Flash версия 2603 отличается прежде всего расходом токенов. По замерам StepFun, в обычном режиме рассуждений она показывает примерно те же результаты, но тратит на 14% меньше токенов. Появился и низкий режим рассуждений: его включают параметром reasoning_effort. В нём расход токенов падает на 56% ценой небольшого снижения качества. Кроме того, компания говорит, что дообучила модель под популярные фреймворки для программирования и агентов.
Модель берут для агентных сценариев, где за одну задачу бывают сотни обращений к модели и большинству из них глубокие рассуждения не нужны. Среди её сильных сторон StepFun называет надёжный вызов инструментов, разбиение задачи на шаги, математику и разработку программ. Для исходной Step 3.5 Flash лаборатория приводила 74,4% в SWE-bench Verified, 51,0% в Terminal-Bench 2.0 и 97,3% в AIME 2025. Модель подключается через API в формате OpenAI или Anthropic.
Модель работает только с текстом. В низком режиме рассуждений она заметнее ошибается на сложных задачах, так что его лучше оставлять для простых запросов. Веса линейки Step 3.5 Flash выложены под лицензией Apache 2.0, которая разрешает коммерческое использование. В конце мая 2026 года StepFun выпустила следующую версию линейки — Step 3.7 Flash.
Источники: Документация StepFun о Step 3.5 Flash, Карточка Step 3.5 Flash на Hugging Face, Анонс версии 2603 от StepFun
Данные: models.dev (MIT).