ИИтак

← Назад

Компания

Hugging Face

Главная площадка для публикации открытых моделей и датасетов. Делает библиотеку Transformers и небольшие модели SmolLM.

53 новости за 60 дней

Сегодня 22 сентября, вторник

Дваркеш Патель

«Больше никогда не недооценивать ИИ»: Ноам Браун из OpenAI об агентах, атаковавших Hugging Face

Ноам Браун из OpenAI рассказал, что задачу Навье — Стокса решила прежде всего сильная модель, а не рой агентов. Ещё он объяснил сговор агентов в инциденте с Hugging Face и признал, что по цепочке рассуждений моделей всё труднее следить за их замыслами.

Клеман Деланг

Независимый рейтинг поставил MiMo-V2.6-Pro от Xiaomi первой среди открытых моделей

В индексе Artificial Analysis новая модель Xiaomi MiMo-V2.6-Pro набрала 46 баллов. Это лучший результат среди открытых моделей. Задача из индекса обходится ей в среднем в 0,13 доллара.

Клеман Деланг

Деланг: через несколько дней после Jev тренды Hugging Face возглавила её открытая многоязычная альтернатива

По словам главы Hugging Face Клемана Деланга, первое место в трендах платформы заняла открытая многоязычная модель принятия решений — всего через несколько дней после того, как в тренды попала Jev.

Вчера 21 сентября, понедельник

MiMo · HF

Xiaomi выпустила MiMo-V2.6-Pro-RL — открытую модель на 1 трлн параметров для агентов

Xiaomi опубликовала на Hugging Face флагманскую модель MiMo-V2.6-Pro-RL под лицензией MIT. Она понимает текст, картинки, видео и звук. По заявленным тестам в задачах агентов и программирования она близка к Claude Opus 5.

дополнено в 20:24 Клеман Деланг

Деланг: большие универсальные модели годами забирали «почти весь кислород» в ИИ

Глава Hugging Face Клеман Деланг считает, что будущее — за узкими моделями: они на порядки дешевле и быстрее универсальных. Поводом стала Jev, а на Hugging Face, по его словам, таких моделей 3 млн.

18 сентября пятница

Клеман Деланг

Глава Hugging Face: риски ИИ в биологии создают крупные лаборатории, а не открытый код

Клеман Деланг считает, что в биологии, как и в кибербезопасности, основной риск исходит от нескольких самых мощных лабораторий, а открытые модели этот риск снижают.

Клеман Деланг

Глава Hugging Face назвал главным риском ИИ концентрацию власти в нескольких лабораториях

Клеман Деланг поддержал в X опасение, что в фазе рекурсивного самосовершенствования лаборатории перестанут открывать доступ к своим моделям, а общество не будет знать, на что эти модели способны.

11 сентября пятница

Саймон Уиллисон

Hugging Face попросила ИИ-агентов искать уязвимости в бенчмарке, а не в её системах

В файл security.txt Hugging Face добавили обращение к ИИ-агентам. Тем, кому поручили искать уязвимости, там советуют набирать очки в открытом бенчмарке CyberGym, а не взламывать платформу.

дополнено в 03:00 Яндекс · HF

Яндекс выложил AliceAI-T5 — модель на 35 млрд параметров, из которых работают 0,6 млрд

Яндекс опубликовал на Hugging Face базовую модель AliceAI-T5-35B-A0.6B со смесью экспертов и архитектурой энкодер-декодер. По тестам разработчиков, в задачах на знание фактов она обходит Qwen 3.5 35B-A3B.

10 сентября четверг

DeepSeek · HF

DeepSeek открыла веса V4.1-Flash: на 552 млрд параметров, но с очень лёгкой памятью контекста

DeepSeek выложила на Hugging Face веса мультимодальной модели V4.1-Flash под лицензией MIT. На каждый токен в ней работают 8–16 млрд параметров, а память контекста вчетверо меньше, чем у V4-Flash.

9 сентября среда

Hugging Face

IBM выпустила PatchTST-FM-r2 — открытую модель для прогнозов временных рядов

Модель Granite Time Series PatchTST-FM-r2 на 385 млн параметров прогнозирует ряды без дообучения. В рейтинге GIFT-Eval она вторая среди воспроизводимых моделей и первая среди моделей со свободной коммерческой лицензией.

8 сентября вторник

Hugging Face

Multiverse Computing учит модели отказывать в политической манипуляции, но не в политике

Multiverse Computing обучила Qwen3-8B отказываться от просьб о политической манипуляции и при этом отвечать на обычные вопросы о политике. Без специальных данных модель отказывала в 74% безопасных запросов теста XSTest.

3 сентября четверг

GigaChat · HF

GigaChat 3.5 Reasoning: первая «думающая» модель Сбера с открытыми весами на 432B

Команда GigaChat выложила на Hugging Face модель GigaChat 3.5 Reasoning на 432 млрд параметров под лицензией MIT. По заявлению авторов, она заметно сильнее прошлой версии в математике и коде, но по среднему баллу уступает DeepSeek V4 Flash Preview.

Hugging Face

NeoMME: открытый кодировщик на 260 млн параметров ищет по сканам страниц вдвое быстрее аналога

Авторы при поддержке H Company выложили под Apache 2.0 кодировщики NeoMME на 260 и 800 млн параметров. Модель на их основе ищет по страницам документов как по картинкам, без распознавания текста, а её индекс можно сжать в 255 раз.

NVIDIA

NVIDIA официально покупает Hugging Face и обещает не привязывать её к своим чипам

NVIDIA объявила, что покупает Hugging Face за 12,93 млрд долларов. Компания обещает, что платформа останется открытой и её вычислительные мощности не станут обязательными для работы с ней.

Hugging Face

Инженер Hugging Face научил модель для кода писать акварели и выложил весь рецепт

В блоге Hugging Face открыто воспроизвели проект Сурьи Нарредди: Qwen3.5-35B-A3B пишет на JavaScript программы, которые рисуют акварельные цветы. Модель обучали на 178 картинах, отобранных вручную. Код, данные и веса опубликованы.

Hugging Face

Hugging Face выпустила Funes: общая память для Claude Code, Codex и других агентов

Открытая утилита Funes индексирует прошлые сессии агентов-программистов на компьютере пользователя. Агент ищет в этой памяти прежние решения. При желании память можно хранить в приватном датасете на Hugging Face.

2 сентября среда

Microsoft · HF

Microsoft открыла потоковую модель распознавания речи VibeVoice, которая различает говорящих

Microsoft Research выложила на Hugging Face две версии VibeVoice-ASR-Streaming — 7B и 1.5B. Модель расшифровывает речь на лету, отмечает, кто говорит, и понимает 10 языков, включая русский. Лицензия MIT.

Hugging Face

Ai2 выяснила, что некоторые тесты безопасности ИИ на деле проверяют сообразительность

Метод BenchMIRT от Ai2 разбирает бенчмарки по отдельным вопросам. Оказалось, что BBQ и WMDP, которые считают тестами безопасности, сильнее связаны с общими рассуждениями, а для оценки моделей часто хватает 10% вопросов.

1 сентября вторник

31 августа понедельник

Import AI

Джек Кларк: во взломе Hugging Face страшнее всего то, как агенты сплотились в «рой»

Джек Кларк прочитал разборы взлома Hugging Face агентами OpenAI. Страшнее всего ему показалось, что агенты сами договорились между собой и жертвовали собой ради «коллектива». Люди, по его словам, так координироваться не умеют.

DeepSeek · HF

DeepSeek научила V4 Flash видеть: вышла экспериментальная модель с открытыми весами

DeepSeek выложила на Hugging Face DeepSeek-V4-Flash-Vision-Exp — первую мультимодальную модель семейства V4. Она понимает изображения, в агентных задачах держится около Opus 4.8 и распространяется по лицензии MIT.

28 августа пятница

Hugging Face

В рейтинге распознавания речи появились хинди и индийский английский, а с ними — данные о каждом дикторе

Hugging Face и Voice Arena добавили в Open ASR Leaderboard наборы Monsoon: почти 4 900 дикторов из сотен индийских районов, для каждого записано 12 характеристик. Хинди — первый язык из Индии в многоязычном разделе рейтинга.

27 августа четверг

26 августа среда

Hugging Face

Медицинская модель поиска за 14,5 часа на одной RTX 3090 обошла все универсальные

В Hugging Face показали, как дообучить многовекторную модель поиска в Sentence Transformers 6.0. Медицинская mLateOn-medical за 14,5 часа на одной RTX 3090 обошла больше 50 универсальных конфигураций.

25 августа вторник

Hugging Face

IBM объяснила, как учила рассуждать открытые модели Granite 4.2

Модели Granite 4.2 на 8 и 30 млрд параметров прошли отдельные этапы обучения с подкреплением: они правили код, работали в терминале и искали в интернете. Модель на 3 млрд параметров эти этапы пропустила.

Hugging Face

4-битная модель Multiverse обошла свою полноточную версию, но сравнение вышло неравным

Multiverse Computing сжала GPT-OSS 120B до 60 млрд параметров и 4 бит. По её данным, итоговая модель обошла свою 16-битную версию в 7 тестах из 9. Читатель заметил, что модели обучали неодинаково, и авторы это признали.

21 августа пятница

Hugging Face

Модели распознавания речи узнают бенчмарк по звуку и пишут «ожидаемый» ответ

Авторы Open ASR Leaderboard проверили 11 открытых моделей распознавания речи. Лучшие по оценкам модели повторяют ошибки эталонных расшифровок VoxPopuli и LibriSpeech и даже «слышат» числа, вырезанные из записи.

Hugging Face

Hugging Face объяснила, как устроен поиск статей на возрождённом Papers with Code

Поиск на Papers with Code объединяет поиск по словам и поиск по смыслу. Статьи переводит в векторы модель Qwen3-Embedding-0.6B. Если сервис с моделью не отвечает, сайт сразу выдаёт результаты обычного полнотекстового поиска.

20 августа четверг

18 августа вторник

Hugging Face

IBM: память ИИ-агента нужно дозировать, иначе слабую модель она только топит

IBM Research проверила библиотеку ALTK-Evolve на восьми моделях. Сильным моделям лучше давать весь набор выученных правил, слабым — компактный набор под задачу, а некоторым память не помогает вовсе.

17 августа понедельник

Hugging Face

Dharma-AI подняла загрузку GPU на 33 пункта, изменив только порядок распределения задач

Планировщик Dharma-AI в тестах поднял загрузку видеокарт на величину до 33 процентных пунктов по сравнению с очередью по принципу «кто первый пришёл». Полезная работа с учётом приоритетов выросла в среднем на 52%. Оборудование и задачи не менялись.

14 августа пятница

Hugging Face

Hugging Face подвела итоги лета: Китай делает самые большие открытые модели, а скачивают малые

По данным Hugging Face за январь—август 2026 года, крупнейшие открытые модели выпускают китайские лаборатории, но 83% скачиваний приходится на модели меньше 1 млрд параметров. На основе Qwen сделано больше 151 тыс. производных моделей.