Весь глоссарий

Глоссарий

RLHF

Также: reinforcement learning from human feedback · обучение с подкреплением на отзывах людей

Обучение с подкреплением на оценках людей: люди сравнивают или оценивают ответы модели, и по этим оценкам модель учат отвечать полезнее и безопаснее.

Пример

Оценщики выбирают лучший из двух ответов на один вопрос; по тысячам таких выборов модель учится, какие ответы предпочтительнее.

Связанные термины

Источник