AIUC получила 40 млн долларов на проверку ИИ-агентов и их страхование
Стартап AIUC сертифицирует ИИ-агентов по собственному стандарту AIUC-1 и подкрепляет сертификат страховкой. Раунд серии A на 40 млн долларов возглавили Ribbit Capital и First Harmonic. Среди клиентов — Cursor, Harvey, Lovable и ElevenLabs.
Стартап AIUC привлёк 40 млн долларов. Он проверяет ИИ-агентов на надёжность и подкрепляет свою оценку настоящей страховкой. Раунд серии A возглавили фонды Ribbit Capital и First Harmonic. О сделке сооснователь и глава компании Руне Квист (Rune Kvist) рассказал в подкасте Latent Space. По его словам, с AIUC уже работают Cursor, Harvey, Lovable и ElevenLabs. В компании всего 20 человек.
Квист был одним из первых сотрудников Anthropic, отвечавших за продукт. Он уверен, что распространение ИИ тормозит уже не нехватка возможностей, а риск. «Сейчас, с Mythos и Fable, очевидно, что главное ограничение для внедрения — это риск», — говорит он. Пример — Waymo. По его словам, машины без водителя давно ездят лучше людей, но в аэропорт на них до сих пор не уехать. Второй сооснователь, Раджив Даттани, раньше был операционным директором METR и там вёл проверку моделей Anthropic и OpenAI перед выпуском.
Главный продукт компании — стандарт AIUC-1 о защите, безопасности и надёжности агентов. В нём три вида требований. Технические: например, фильтр, который отсекает выдуманные ответы. Испытательные: независимая сторона раз в квартал прогоняет тысячи сценариев и смотрит, удаётся ли взломать агента, как часто он галлюцинирует и выдаёт ли данные. Организационные: должен быть ответственный с конкретным именем и план на случай сбоя. Наличие мер проверяют аудиторы вроде KPMG и Schellman. Сертификация занимает от 3 до 10 недель, в зависимости от того, насколько компания готова.
Сам стандарт тоже обновляется каждый квартал. Дважды в квартал AIUC собирает консорциум руководителей по рискам из банков, больниц и критической инфраструктуры. Они рассказывают, что их сейчас беспокоит. Недавно это были взаимодействие агентов между собой, протокол MCP и агенты для программирования. Если агент прошёл проверку, страховщики берут часть риска на себя.
Следующим шагом Квист называет проверку уже самих моделей, а не построенных на них агентов. Официально об этом пока не объявили. Он считает, что между государством и лабораториями нужен нейтральный посредник, вроде рейтингового агентства Moody's на рынке облигаций. «Нет другой отрасли, где разрешают проверять самих себя», — говорит Квист. Правда, AIUC тоже получает деньги от тех, кого проверяет.