Глоссарий терминов искусственного интеллекта

Что такое Предохранительный фильтр?

Определение

Уровень модерации, который блокирует или перезаписывает небезопасные входные или выходные данные модели.

Связанные термины

Контролируемое обучение
Обучение модели с помощью размеченных примеров, которые сопоставляют входные данные с известными выходными данными.
Обоснование безопасности
Структурированный аргумент, подкрепленный доказательствами, о том, что система ИИ безопасна для определенного контекста использования.
Выравнивание ИИ
Работа по обеспечению поведения систем ИИ в соответствии с человеческими намерениями, ценностями и ограничениями безопасности.
Безопасность ИИ
Область, ориентированная на снижение вредного поведения, сбоев и рисков неправильного использования в системах искусственного интеллекта.
Алгоритмическое смещение
Систематическая несправедливость в результатах модели, вызванная искажением данных, предположениями или выбором моделирования.
Маркировка данных
Процесс назначения тегов или целевых результатов необработанным данным для контролируемого обучения.

Узнайте больше в наших бесплатных руководствах.

См. также