Глоссарий терминов искусственного интеллекта

Что такое Модель человеческих предпочтений?

Определение

Модель, обученная на человеческом рейтинге, чтобы предсказать, какие ответы пользователи, скорее всего, предпочтут.

Связанные термины

Обучение с подкреплением на основе обратной связи с человеком (RLHF)
Метод обучения, который использует сигналы человеческих предпочтений для формирования поведения модели.
Человек в курсе
Рабочий процесс, в котором люди проверяют, направляют или игнорируют результаты ИИ.
AGI (Общий искусственный интеллект)
Гипотетическая система искусственного интеллекта, способная выполнять большинство интеллектуальных задач на человеческом уровне во многих областях.
Выравнивание ИИ
Работа по обеспечению поведения систем ИИ в соответствии с человеческими намерениями, ценностями и ограничениями безопасности.
Алгоритмическая прозрачность
Насколько четко документированы и понятны логика, источники данных и ограничения системы ИИ.
Аннотация
Добавленные человеком метки или метаданные, используемые для обучения или оценки моделей машинного обучения.

Узнайте больше в наших бесплатных руководствах.

См. также