ИИтак

← Назад

Тема

#открытые модели

Модели с открытыми весами и кодом: их можно скачать, запустить у себя и дообучить.

40 новостей за 60 дней

Сегодня 22 сентября, вторник

MiMo · HF

Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

Xiaomi выложила MiMo-V2.6-Distill-Qwen-9B — модель Qwen3.5-9B, дообученную на данных от MiMo. Её предлагают как отправную точку для исследований обучения агентов с подкреплением. По заявленным тестам она заметно обходит исходную Qwen.

Клеман Деланг

Независимый рейтинг поставил MiMo-V2.6-Pro от Xiaomi первой среди открытых моделей

В индексе Artificial Analysis новая модель Xiaomi MiMo-V2.6-Pro набрала 46 баллов. Это лучший результат среди открытых моделей. Задача из индекса обходится ей в среднем в 0,13 доллара.

Клеман Деланг

Деланг: через несколько дней после Jev тренды Hugging Face возглавила её открытая многоязычная альтернатива

По словам главы Hugging Face Клемана Деланга, первое место в трендах платформы заняла открытая многоязычная модель принятия решений — всего через несколько дней после того, как в тренды попала Jev.

Вчера 21 сентября, понедельник

дополнено в 23:24 MiMo · HF

Xiaomi выпустила MiMo-V2.6-Pro-RL — открытую модель на 1 трлн параметров для агентов

Xiaomi опубликовала на Hugging Face флагманскую модель MiMo-V2.6-Pro-RL под лицензией MIT. Она понимает текст, картинки, видео и звук. По заявленным тестам в задачах агентов и программирования она близка к Claude Opus 5.

Interconnects

Натан Ламберт рассказал Конгрессу, насколько Китай обогнал США в открытых моделях

По оценке Ламберта, китайские открытые модели отстают от закрытых американских на 2–5 месяцев, а американские открытые — на 6–9. Китайским моделям достаётся больше 80% токенов на OpenRouter, а Qwen упоминают в 30% научных статей.

Илон Маск

«Интеллект растёт экспоненциально»: Маск о малых открытых моделях, обошедших лидеров 2025 года

Илон Маск репостнул утверждение, что GLM 5.3 Flash, DeepSeek V4.1 Flash и две модели Qwen 3.8 сильнее всех передовых моделей Рождества 2025 года, и добавил: «Интеллект растёт экспоненциально».

Яндекс

Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

Яндекс официально представил базовую модель Alice AI Foundation на 80 млрд параметров. Вместе с ней компания открыла два бенчмарка для проверки знаний на русском. Модель служит полигоном для будущей рассуждающей модели Алисы AI.

дополнено в 06:23 Qwen · HF

Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

Qwen открыла Qwen-Image-2.1-PE-I2I — модель, которая берёт невнятную команду на правку и картинку и переписывает их в подробный запрос для редактора изображений. Это дообученная Qwen3.5-VL на 9 млрд параметров.

19 сентября суббота

Яндекс · HF

Яндекс выложил открытую базовую модель AliceAI-Foundation на 80 млрд параметров

AliceAI-Foundation-80B-A3B-Base обучена с нуля и распространяется по лицензии Apache 2.0. На каждый токен модель задействует 3 млрд параметров и принимает до 262 144 токенов контекста. По данным Яндекса, особенно сильна она в русскоязычных вопросах на знание фактов.

18 сентября пятница

Anthropic · X

Claude за четыре недели ускорил в среднем вчетверо 30 открытых моделей для биологии

Claude ускорил более 30 открытых моделей для биологии: в среднем они работают вчетверо быстрее. Крупные белковые комплексы теперь считаются на одном узле с GPU. Anthropic выложила код и вместе с Adaptyv Bio объявила конкурс по дизайну белков.

17 сентября четверг

15 сентября вторник

NVIDIA

Детская больница Филадельфии моделирует сердца детей на открытых ИИ-инструментах NVIDIA

Детская больница Филадельфии строит модели сердца за секунды вместо часов с помощью открытых инструментов MONAI и 3D Slicer. Модели помогают подбирать устройства при врождённых пороках.

14 сентября понедельник

MiniMax · X

Открытую видеомодель MiniMax H3 сообщество ускорило и запустило на домашних видеокартах

Для видеомодели MiniMax H3 со встроенным звуком собрали каталог ускорений и сжатых версий. Одна из сборок, по словам её авторов, работает на картах с 8 ГБ видеопамяти. В другой 14-секундный ролик на восьми B200 генерируется быстрее, чем проигрывается.

11 сентября пятница

Interconnects

Натан Ламберт собрал список лучших текстов об открытых моделях

Автор Interconnects выложил подборку для тех, кто пишет об открытых моделях для политиков и широкой публики: зачем их выпускают, чем они рискуют и как в этой области соперничают США и Китай.

Яндекс

Яндекс открыл базовую модель, на которой работают быстрые ИИ-ответы в Поиске

Alice AI Search Pretrain на 35 млрд параметров доступна на Hugging Face под лицензией Apache 2.0. Её дообученная версия с июля пишет ответы под поисковой строкой Яндекса, ими пользуются более 49 млн человек в месяц.

Cohere

Cohere выпустила открытую модель-переводчик North Small Translate: по её тестам она обходит DeepL и Google

North Small Translate переводит на 50 с лишним языков. Веса открыты только для исследований и некоммерческого применения, а компаниям модель доступна через сервис Language Weaver от RWS.

10 сентября четверг

Яндекс · HF

Яндекс выложил AliceAI-T5 — модель на 35 млрд параметров, из которых работают 0,6 млрд

Яндекс опубликовал на Hugging Face базовую модель AliceAI-T5-35B-A0.6B со смесью экспертов и архитектурой энкодер-декодер. По тестам разработчиков, в задачах на знание фактов она обходит Qwen 3.5 35B-A3B.

DeepSeek · HF

DeepSeek открыла веса V4.1-Flash: на 552 млрд параметров, но с очень лёгкой памятью контекста

DeepSeek выложила на Hugging Face веса мультимодальной модели V4.1-Flash под лицензией MIT. На каждый токен в ней работают 8–16 млрд параметров, а память контекста вчетверо меньше, чем у V4-Flash.

9 сентября среда

Hugging Face

IBM выпустила PatchTST-FM-r2 — открытую модель для прогнозов временных рядов

Модель Granite Time Series PatchTST-FM-r2 на 385 млн параметров прогнозирует ряды без дообучения. В рейтинге GIFT-Eval она вторая среди воспроизводимых моделей и первая среди моделей со свободной коммерческой лицензией.

8 сентября вторник

Interconnects

Z.ai закрутила лицензию GLM-5.3: гигантам с выручкой от 10 млрд долларов нужна её проверка

Z.ai перевела GLM-5.3 с лицензии MIT на собственную. Облачным провайдерам с выручкой больше 10 млрд долларов в год нужна проверка безопасности от Z.ai. Interconnects видит в этом тренд: китайские лидеры закрывают лицензии, а западные компании их открывают.

3 сентября четверг

GigaChat · HF

GigaChat 3.5 Reasoning: первая «думающая» модель Сбера с открытыми весами на 432B

Команда GigaChat выложила на Hugging Face модель GigaChat 3.5 Reasoning на 432 млрд параметров под лицензией MIT. По заявлению авторов, она заметно сильнее прошлой версии в математике и коде, но по среднему баллу уступает DeepSeek V4 Flash Preview.

Latent Space

Meta выпустила Muse Spark 1.3 — модель уровня GPT-5.6 Sol с обещанием открытых весов

Muse Spark 1.3 от Meta сравнялась с GPT-5.6 Sol и Claude Opus 5 на агентных задачах и программировании. Веса обещают открыть, а тем, кто разрешит обучать на своих данных, модель обойдётся более чем на 90% дешевле.

2 сентября среда

Microsoft · HF

Microsoft открыла потоковую модель распознавания речи VibeVoice, которая различает говорящих

Microsoft Research выложила на Hugging Face две версии VibeVoice-ASR-Streaming — 7B и 1.5B. Модель расшифровывает речь на лету, отмечает, кто говорит, и понимает 10 языков, включая русский. Лицензия MIT.

1 сентября вторник

NVIDIA для разработчиков

NVIDIA и CrowdStrike столкнули ИИ-агентов атаки и защиты. Открытые модели выиграли по качеству

Агент-защитник на открытых моделях Nemotron писал правила обнаружения атак реже, чем закрытая передовая система, но чаще попадал. Три его правила прошли все проверки и поймали все восемь новых атак, у конкурента таких не нашлось.

Latent Space

Открытые ИИ-проекты перестают принимать чужой код: вместо людей правки пишут свои агенты

Авторы AI SDK, Astro, Flue и Tldraw поручают исправления своим агентам. Flue и Tldraw автоматически закрывают пул-реквесты от внешних участников. У Vercel агенты уже пишут 25–35% принятых правок.

31 августа понедельник

DeepSeek · HF

DeepSeek научила V4 Flash видеть: вышла экспериментальная модель с открытыми весами

DeepSeek выложила на Hugging Face DeepSeek-V4-Flash-Vision-Exp — первую мультимодальную модель семейства V4. Она понимает изображения, в агентных задачах держится около Opus 4.8 и распространяется по лицензии MIT.

25 августа вторник

дополнено в 18:14 IBM Research

IBM выпустила открытые модели Granite 4.2 для агентов и крошечную модель распознавания речи

Модели Granite 4.2 на 3, 8 и 30 млрд параметров умеют рассуждать перед ответом и вызывать инструменты. Вместе с ними вышла модель распознавания речи на 470 млн параметров, которая работает даже на ноутбуке.

20 августа четверг

Google для разработчиков

Открытые модели Gemma скачали миллиард раз: от спутников до расшифровки дельфинов

Модели Gemma скачали больше миллиарда раз, разработчики выложили свыше 100 тысяч их вариантов. Google показала, где их применяют, и открыла на GitHub каталог Awesome Gemma.

14 августа пятница

Hugging Face

Hugging Face подвела итоги лета: Китай делает самые большие открытые модели, а скачивают малые

По данным Hugging Face за январь—август 2026 года, крупнейшие открытые модели выпускают китайские лаборатории, но 83% скачиваний приходится на модели меньше 1 млрд параметров. На основе Qwen сделано больше 151 тыс. производных моделей.

11 августа вторник

NVIDIA для разработчиков

NVIDIA выпустила Nemotron 3.5 Lightning — малую открытую модель для рутинной работы агентов

Nemotron 3.5 Lightning — открытая модель на 30 млрд параметров, из которых на каждый токен работают 3 млрд. Она берёт на себя рутинные шаги ИИ-агентов, а планирование оставляет крупным моделям.

Mistral AI

Mistral даёт выбрать, где работает модель, и собирает компании строить европейские дата-центры

Клиенты Mistral теперь сами выбирают, в Европе или в США запускать модели. Кроме того, компания открыла приоритетный тариф с гарантией доступности, добавила на платформу чужие открытые модели и собирает коалицию для постройки до 1 ГВт мощностей к 2030 году.

10 августа понедельник

Hugging Face

NVIDIA научила открытую модель синтеза речи Magpie TTS арабскому, корейскому и португальскому

Модель Magpie TTS Multilingual на 364 млн параметров теперь говорит на 12 языках. На B200 первый звук она выдаёт через 32 мс, а запускать её можно на своих серверах.

Hugging Face

Meta выпустила Muse Glimmer — открытую модель на 30 млрд параметров для локальных агентов

Muse Glimmer получена дистилляцией из Muse и вышла под лицензией Apache 2.0. Модель понимает текст, изображения и видео без звука и рассчитана на запуск на собственном железе.

3 августа понедельник

Interconnects

Interconnects открыла каталог открытых моделей и ежедневную статистику США против Китая

Рассылка Interconnects запустила два бесплатных проекта: Artifacts Hub с 792 отобранными открытыми моделями и дашборд их скачиваний и производных моделей по странам и организациям.

2 августа воскресенье

Interconnects

Лаборатории не объединяются, а множатся: Interconnects разобрал свежие открытые модели

В новом обзоре открытых моделей Interconnects выделил Inkling от Thinking Machines, Kimi K3, Hy3 от Tencent на лицензии Apache 2 и Laguna S2.1 от Poolside. Авторы делают вывод: сильные модели теперь обучает всё больше компаний.

31 июля пятница

Thinking Machines

Thinking Machines рассказала, как проверяла открытые модели Inkling перед выпуском

Thinking Machines считает, что Inkling и Inkling-Small не добавляют заметного риска по сравнению с уже доступными открытыми моделями. Более мощные модели компания предлагает открывать поэтапно.

27 июля понедельник

NVIDIA для разработчиков

Nemotron 3 Ultra лучше других открытых моделей проектирует микросхемы и тратит меньше токенов

В агенте ACE-RTL модель NVIDIA Nemotron 3 Ultra решила в среднем 97,1% задач бенчмарка CVDP по проектированию микросхем. Это больше, чем у GLM 5.2 и Kimi K2.6, а токенов на один шаг модель тратит заметно меньше обеих.