ИИтак

← Назад

DeepSeek выпустила V4.1-Flash и отключает свой флагман V4-Pro: младшая модель оказалась лучше

DeepSeek выпустила в API модель V4.1-Flash, которая понимает изображения, и снизила цены. С 14 сентября запросы к V4-Pro уходят на новую модель по её тарифам — до выхода V4.1-Pro.

Изображение: DeepSeek

DeepSeek выпустила модель V4.1-Flash и тут же отказывается от своего флагмана V4-Pro. По словам компании, новая младшая модель обходит старшую по качеству, цене, скорости и общему времени выполнения задач. Это подтверждают, как утверждает DeepSeek, тесты нескольких независимых сторон.

V4.1-Flash — самая маленькая модель нового семейства. DeepSeek называет его архитектуру асимметричной: у модели 552 млрд параметров, но на чтение входных данных работают только 8 млрд, а на генерацию ответа — 16 млрд. Высокого качества, по словам разработчиков, помогли добиться новые методы предобучения и дообучение с подкреплением в большем масштабе. Изображения модель понимает сама, без отдельной версии.

Главная экономия связана с кэшем. Промежуточные данные, которые модель хранит для длинного разговора, теперь занимают вчетверо меньше видеопамяти и в восемь раз меньше места на дисках. DeepSeek напоминает, что при работе агентов плата за повторное чтение из кэша часто составляет большую долю счёта, так что сжатие кэша заметно удешевляет агентов.

Новые цены в API действуют с 10 сентября. Точных сумм в тексте анонса нет. Сохраняется деление на пиковые и непиковые часы: в непиковые часы запросы стоят вдвое дешевле, и компания советует переносить на это время задачи, которые не горят.

Прежние V4-Flash и экспериментальная V4-Flash-Vision-Exp, которую DeepSeek выложила в конце августа, сняты с поддержки. Запросы к ним временно перенаправляются на V4.1-Flash. С 14 сентября на новую модель уходят и все запросы к V4-Pro, причём по тарифам Flash. Так будет, пока не выйдет V4.1-Pro, сроков её выхода компания не называет.

Выложит ли DeepSeek веса V4.1-Flash в открытый доступ, из анонса не ясно. Компания обещает только помочь сообществу разработчиков открытого кода с поддержкой запуска модели и предлагает связаться с ней тем, кто планирует развернуть модель на 2 000 видеокарт.

← Все новости