ИИтак

← Назад

Компания

Alibaba

Китайский технологический гигант. Его команда Qwen выпускает одно из крупнейших семейств открытых моделей.

17 новостей за 60 дней

Сегодня 22 сентября, вторник

MiMo · HF

Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

Xiaomi выложила MiMo-V2.6-Distill-Qwen-9B — модель Qwen3.5-9B, дообученную на данных от MiMo. Её предлагают как отправную точку для исследований обучения агентов с подкреплением. По заявленным тестам она заметно обходит исходную Qwen.

Вчера 21 сентября, понедельник

Interconnects

Натан Ламберт рассказал Конгрессу, насколько Китай обогнал США в открытых моделях

По оценке Ламберта, китайские открытые модели отстают от закрытых американских на 2–5 месяцев, а американские открытые — на 6–9. Китайским моделям достаётся больше 80% токенов на OpenRouter, а Qwen упоминают в 30% научных статей.

Илон Маск

«Интеллект растёт экспоненциально»: Маск о малых открытых моделях, обошедших лидеров 2025 года

Илон Маск репостнул утверждение, что GLM 5.3 Flash, DeepSeek V4.1 Flash и две модели Qwen 3.8 сильнее всех передовых моделей Рождества 2025 года, и добавил: «Интеллект растёт экспоненциально».

дополнено в 06:26 Qwen · X

19 сентября суббота

Qwen · X

Alibaba выпустила Qwen3.8-LiveTranslate — модель для синхронного перевода речи и видео

Qwen3.8-LiveTranslate переводит живую речь и видео, понимает 60 языков, озвучивает перевод на 29 и отстаёт от говорящего в среднем на 2,3 секунды вместо 2,8. Модель различает собеседников и сохраняет их голоса.

18 сентября пятница

Qwen · X

Alibaba выпустила Qwen3.8-Omni-Flash — модель, которая смотрит видео, слушает звук и работает с инструментами

Qwen3.8-Omni-Flash принимает текст, картинки, звук и видео, держит контекст до 1 млн токенов и умеет вызывать инструменты. По данным Alibaba, обработка видео стоит примерно на 89% меньше, чем у Qwen3.5-Omni-Plus.

16 сентября среда

NVIDIA

Vera Rubin NVL72 в MLPerf: до 3,7 раза быстрее GB300 на Qwen3-VL и в 2,5 раза на DeepSeek-R1

NVIDIA раскрыла подробности первых результатов Vera Rubin NVL72 в тесте MLPerf Inference v6.1. На Qwen3-VL стойка до 3,7 раза производительнее GB300 NVL72, на DeepSeek-R1 — до 2,5 раза. Четыре стойки GB300 масштабируются с эффективностью 99%.

8 сентября вторник

Hugging Face

Multiverse Computing учит модели отказывать в политической манипуляции, но не в политике

Multiverse Computing обучила Qwen3-8B отказываться от просьб о политической манипуляции и при этом отвечать на обычные вопросы о политике. Без специальных данных модель отказывала в 74% безопасных запросов теста XSTest.

3 сентября четверг

Hugging Face

Инженер Hugging Face научил модель для кода писать акварели и выложил весь рецепт

В блоге Hugging Face открыто воспроизвели проект Сурьи Нарредди: Qwen3.5-35B-A3B пишет на JavaScript программы, которые рисуют акварельные цветы. Модель обучали на 178 картинах, отобранных вручную. Код, данные и веса опубликованы.

26 августа среда

NVIDIA для разработчиков

Alibaba открыла веса Qwen3.8-Flash-Next — модели, по которой можно судить о будущем Qwen4

Alibaba выложила веса Qwen3.8-Flash-Next: 125 млрд параметров, из них на каждый токен работают 6 млрд, контекст — до 1 млн токенов. На стойке GB300 NVL72 модель выдаёт больше 200 токенов в секунду на пользователя.

21 августа пятница

Hugging Face

Hugging Face объяснила, как устроен поиск статей на возрождённом Papers with Code

Поиск на Papers with Code объединяет поиск по словам и поиск по смыслу. Статьи переводит в векторы модель Qwen3-Embedding-0.6B. Если сервис с моделью не отвечает, сайт сразу выдаёт результаты обычного полнотекстового поиска.

14 августа пятница

Hugging Face

Hugging Face подвела итоги лета: Китай делает самые большие открытые модели, а скачивают малые

По данным Hugging Face за январь—август 2026 года, крупнейшие открытые модели выпускают китайские лаборатории, но 83% скачиваний приходится на модели меньше 1 млрд параметров. На основе Qwen сделано больше 151 тыс. производных моделей.

12 августа среда

NVIDIA для разработчиков

Alibaba открыла веса Qwen3.8-Max на 2,4 трлн параметров, NVIDIA показала её скорость

Qwen3.8-2.4T-A95B — крупнейшая модель Alibaba с открытыми весами: 2,4 трлн параметров и контекст до миллиона токенов. На стойке GB300 NVL72 она уже в день выхода выдаёт больше 350 токенов в секунду на пользователя.