콘텐츠로 건너뛰기
학습
뉴스
도구
채용
미션
검색
⌘K
English
기부
메뉴
여기서 시작하세요
학습 시작
학습
이동 학습
행동
가이드
AI 튜터
프롬프트 라이브러리
퀴즈
인증
용어집
뉴스
이동 뉴스
최신 AI 뉴스
주제 추적기
연구 및 데이터 세트
블로그
편집 원칙
정정 안내
도구
이동 도구
도구 디렉토리
최고의 목록
도구 비교
비용 계산기
프롬프트 구체화
AI 도구 제출
채용
이동 채용
AI 채용 검색
채용 공고 게시
후원 AIU
미션
이동 미션
미션
영향 및 통계
저자
도움말 센터
새로운 소식
지원
기부
← 모든 퀴즈로 돌아가기
가이드 연계 퀴즈 • 하드 레벨 • 6 질문
인간 피드백 퀴즈를 통한 강화 학습
RLHF 이면의 단계와 메커니즘에 대한 이해도를 테스트해 보세요.
관련 가이드 경로
인간 피드백을 통한 강화 학습
질문 1 의 6
언어 모델에 대한 RLHF의 주요 목적은 무엇입니까?
힌트가 필요하신가요?
A
모델의 매개변수 수를 늘리려면
B
유용성과 안전성에 대한 인간의 선호에 맞춰 출력을 조정합니다.
C
더 빠른 추론을 위해 모델을 압축하려면
D
모델을 다른 언어로 번역하려면