Caesar AI Atlas

Человеческая оценка

Caesar AI Atlas Definition

Человеческая оценка — процесс, при котором люди оценивают качество, безопасность, полезность или корректность выходов модели. Она особенно важна для задач, где нет единственного правильного ответа, таких как качество перевода, суммирование, диалог или творческая генерация.

Other Definitions

Человеческая оценка Source

A process in which people judge the quality of an ML model's output; for example, having bilingual people judge the quality of an ML translation model. Human evaluation is particularly useful for judging models that have no one right answer. Contrast with automatic evaluation and autorater evaluation.

Related Terms