Словарь
TRL
TRL (Transformer Reinforcement Learning) — открытая библиотека Hugging Face для дообучения языковых моделей: обучение с учителем на примерах (SFT), обучение с подкреплением и методы выравнивания по предпочтениям (GRPO, DPO, обучение моделей вознаграждения). Интегрирована с библиотекой Transformers и позволяет масштабировать обучение от одной видеокарты до кластера.