Словарь
LLM-as-a-judge
Подход к оценке качества ответов ИИ-систем (LLM-as-a-judge), при котором вердикт выносит другая языковая модель, а не человек-эксперт. Такая оценка дешевле и масштабируется, но подвержена систематическим смещениям — например, к длинным ответам, к порядку сравниваемых вариантов и к собственным ответам модели-судьи.