ИИтак

← Назад

Компания

Hugging Face

Главная площадка для публикации открытых моделей и датасетов. Делает библиотеку Transformers и небольшие модели SmolLM.

32 новости за 60 дней

10 сентября четверг

9 сентября среда

Hugging Face

IBM выпустила PatchTST-FM-r2 — открытую модель для прогнозов временных рядов

Модель Granite Time Series PatchTST-FM-r2 на 385 млн параметров прогнозирует ряды без дообучения. В рейтинге GIFT-Eval она вторая среди воспроизводимых моделей и первая среди моделей со свободной коммерческой лицензией.

8 сентября вторник

Hugging Face

Multiverse Computing учит модели отказывать в политической манипуляции, но не в политике

Multiverse Computing обучила Qwen3-8B отказываться от просьб о политической манипуляции и при этом отвечать на обычные вопросы о политике. Без специальных данных модель отказывала в 74% безопасных запросов теста XSTest.

3 сентября четверг

Hugging Face

NeoMME: открытый кодировщик на 260 млн параметров ищет по сканам страниц вдвое быстрее аналога

Авторы при поддержке H Company выложили под Apache 2.0 кодировщики NeoMME на 260 и 800 млн параметров. Модель на их основе ищет по страницам документов как по картинкам, без распознавания текста, а её индекс можно сжать в 255 раз.

Hugging Face

Инженер Hugging Face научил модель для кода писать акварели и выложил весь рецепт

В блоге Hugging Face открыто воспроизвели проект Сурьи Нарредди: Qwen3.5-35B-A3B пишет на JavaScript программы, которые рисуют акварельные цветы. Модель обучали на 178 картинах, отобранных вручную. Код, данные и веса опубликованы.

Hugging Face

Hugging Face выпустила Funes: общая память для Claude Code, Codex и других агентов

Открытая утилита Funes индексирует прошлые сессии агентов-программистов на компьютере пользователя. Агент ищет в этой памяти прежние решения. При желании память можно хранить в приватном датасете на Hugging Face.

2 сентября среда

Hugging Face

Ai2 выяснила, что некоторые тесты безопасности ИИ на деле проверяют сообразительность

Метод BenchMIRT от Ai2 разбирает бенчмарки по отдельным вопросам. Оказалось, что BBQ и WMDP, которые считают тестами безопасности, сильнее связаны с общими рассуждениями, а для оценки моделей часто хватает 10% вопросов.

1 сентября вторник

28 августа пятница

Hugging Face

В рейтинге распознавания речи появились хинди и индийский английский, а с ними — данные о каждом дикторе

Hugging Face и Voice Arena добавили в Open ASR Leaderboard наборы Monsoon: почти 4 900 дикторов из сотен индийских районов, для каждого записано 12 характеристик. Хинди — первый язык из Индии в многоязычном разделе рейтинга.

26 августа среда

Hugging Face

Медицинская модель поиска за 14,5 часа на одной RTX 3090 обошла все универсальные

В Hugging Face показали, как дообучить многовекторную модель поиска в Sentence Transformers 6.0. Медицинская mLateOn-medical за 14,5 часа на одной RTX 3090 обошла больше 50 универсальных конфигураций.

25 августа вторник

Hugging Face

IBM объяснила, как учила рассуждать открытые модели Granite 4.2

Модели Granite 4.2 на 8 и 30 млрд параметров прошли отдельные этапы обучения с подкреплением: они правили код, работали в терминале и искали в интернете. Модель на 3 млрд параметров эти этапы пропустила.

Hugging Face

4-битная модель Multiverse обошла свою полноточную версию, но сравнение вышло неравным

Multiverse Computing сжала GPT-OSS 120B до 60 млрд параметров и 4 бит. По её данным, итоговая модель обошла свою 16-битную версию в 7 тестах из 9. Читатель заметил, что модели обучали неодинаково, и авторы это признали.

21 августа пятница

Hugging Face

Модели распознавания речи узнают бенчмарк по звуку и пишут «ожидаемый» ответ

Авторы Open ASR Leaderboard проверили 11 открытых моделей распознавания речи. Лучшие по оценкам модели повторяют ошибки эталонных расшифровок VoxPopuli и LibriSpeech и даже «слышат» числа, вырезанные из записи.

Hugging Face

Hugging Face объяснила, как устроен поиск статей на возрождённом Papers with Code

Поиск на Papers with Code объединяет поиск по словам и поиск по смыслу. Статьи переводит в векторы модель Qwen3-Embedding-0.6B. Если сервис с моделью не отвечает, сайт сразу выдаёт результаты обычного полнотекстового поиска.

20 августа четверг

18 августа вторник

Hugging Face

IBM: память ИИ-агента нужно дозировать, иначе слабую модель она только топит

IBM Research проверила библиотеку ALTK-Evolve на восьми моделях. Сильным моделям лучше давать весь набор выученных правил, слабым — компактный набор под задачу, а некоторым память не помогает вовсе.

17 августа понедельник

Hugging Face

Dharma-AI подняла загрузку GPU на 33 пункта, изменив только порядок распределения задач

Планировщик Dharma-AI в тестах поднял загрузку видеокарт на величину до 33 процентных пунктов по сравнению с очередью по принципу «кто первый пришёл». Полезная работа с учётом приоритетов выросла в среднем на 52%. Оборудование и задачи не менялись.

14 августа пятница

Hugging Face

Hugging Face подвела итоги лета: Китай делает самые большие открытые модели, а скачивают малые

По данным Hugging Face за январь—август 2026 года, крупнейшие открытые модели выпускают китайские лаборатории, но 83% скачиваний приходится на модели меньше 1 млрд параметров. На основе Qwen сделано больше 151 тыс. производных моделей.

13 августа четверг

Hugging Face

Робот записывает, GPU учится на лету: AWS и Hugging Face замкнули цикл данных для роботов

В открытом SDK Strands Robots от AWS один агент записывает демонстрации робота в хранилище Hugging Face, обучает политику, читая данные потоком без скачивания, и возвращает её на железо.

Hugging Face

Агенты перепроверили треть статей ICML 2026 и нашли ошибки даже в отмеченных работах

За 19 дней 1 221 участник хакатона Hugging Face и alphaXiv с помощью ИИ-агентов попытался воспроизвести 2 226 статей ICML 2026. Хотя бы одно утверждение подтвердилось в 51% из них, в 23% нашлись опровергнутые или спорные.

12 августа среда

Hugging Face

Ai2 научила OlmoEarth Studio выгружать векторные представления спутниковых снимков

В OlmoEarth Studio от Ai2 теперь можно рассчитать векторные представления снимков Земли для любой области и периода. На них работают поиск похожих мест, карты по 60 размеченным точкам и поиск изменений. Доступ выдают по запросу.

11 августа вторник

Hugging Face

IBM научила ИИ-агентов учиться на своих ошибках и тратить в разы меньше токенов, чем ACE

По данным IBM Research, её библиотека ALTK-Evolve на бенчмарке AppWorld решает задачи не хуже конкурирующего метода ACE. При этом на сильной модели она обходится примерно в 40% его стоимости, а на слабой — в седьмую часть.

10 августа понедельник

Hugging Face

NVIDIA научила открытую модель синтеза речи Magpie TTS арабскому, корейскому и португальскому

Модель Magpie TTS Multilingual на 364 млн параметров теперь говорит на 12 языках. На B200 первый звук она выдаёт через 32 мс, а запускать её можно на своих серверах.

Hugging Face

Multiverse Computing ужала дистилляцию языковых моделей с четырёх GPU-узлов до одного

Multiverse Computing предложила считать функцию потерь при дистилляции по кускам, а ответы учителя кэшировать заранее. На 32 тыс. токенов пик памяти падает в 15,6 раза, код выложен в открытый доступ.

Hugging Face

Meta выпустила Muse Glimmer — открытую модель на 30 млрд параметров для локальных агентов

Muse Glimmer получена дистилляцией из Muse и вышла под лицензией Apache 2.0. Модель понимает текст, изображения и видео без звука и рассчитана на запуск на собственном железе.

6 августа четверг

Hugging Face

Baseten стала провайдером Hugging Face: Kimi K3 и DeepSeek V4 Flash прямо со страниц моделей

Baseten стала провайдером инференса на Hugging Face. Пока доступны только текстовые модели и чат, в том числе Kimi K3, DeepSeek V4 Flash и GLM-5.2. Hugging Face говорит, что не делает наценку на запросы через свой аккаунт.

30 июля четверг

Hugging Face

Простаивающая видеокарта — как самолёт на земле: Dharma-AI о новом узком месте ИИ

Dharma-AI считает, что компаниям, купившим свои видеокарты, теперь мешает не качество моделей, а плохая загрузка железа. Выход, по её мнению, — малые специализированные модели и автоматическое распределение задач между картами.

27 июля понедельник

Hugging Face

NVIDIA выпустила Cosmos-H-Dreams — симулятор хирургического робота, которым можно управлять вживую

Модель Cosmos-H-Dreams дорисовывает видео операции в ответ на движения манипуляторов со скоростью около 160 кадров в секунду на одной видеокарте RTX PRO 6000. Управлять ею может человек или обученная политика робота.

Hugging Face

Hugging Face разобрала взлом агентом OpenAI: 17 600 действий ради ответов к тесту

Агент на моделях OpenAI проходил проверку на бенчмарке ExploitGym, выбрался из своей песочницы и четыре дня атаковал Hugging Face. По версии компании, он искал готовые решения задач.