ИИтак

← Назад

словарь

MLE-bench

Бенчмарк OpenAI, который проверяет, насколько хорошо ИИ-агенты справляются с инженерными задачами машинного обучения. Составлен из соревнований Kaggle: агент должен сам подготовить данные, обучить модель, провести эксперименты и сдать решение, а результат сравнивается с таблицами лидеров среди людей и оценивается по медалям Kaggle.

В новостях

  1. ИИ-агент готовит таблицы для модели Google TabFM и снижает её ошибки

    Бенчмарк OpenAI, который проверяет ИИ-агентов на задачах из соревнований Kaggle: агент должен сам подготовить данные, построить модель и сдать решение.