콘텐츠로 건너뛰기
학습
뉴스
도구
채용
미션
검색
⌘K
English
기부
메뉴
여기서 시작하세요
학습 시작
학습
이동 학습
행동
가이드
AI 튜터
프롬프트 라이브러리
퀴즈
인증
용어집
뉴스
이동 뉴스
최신 AI 뉴스
주제 추적기
연구 및 데이터 세트
블로그
편집 원칙
정정 안내
도구
이동 도구
도구 디렉토리
최고의 목록
도구 비교
비용 계산기
프롬프트 구체화
AI 도구 제출
채용
이동 채용
AI 채용 검색
채용 공고 게시
후원 AIU
미션
이동 미션
미션
영향 및 통계
저자
도움말 센터
새로운 소식
지원
기부
홈
/
용어집
/
훈련 후
AI 용어집
무엇입니까?
훈련 후
?
정의
명령어 튜닝, 선호도 최적화, 안전 튜닝 등 사전 학습 이후 적용되는 학습 단계입니다.
관련 용어
DPO(직접 선호도 최적화)
별도의 보상 모델이 필요 없이 선호 쌍에 대해 직접 모델을 미세 조정하는 학습 방법입니다.
중간 훈련
사전 훈련과 사후 훈련 사이의 중간 훈련 단계로, 역량이나 영역 조정에 자주 사용됩니다.
매개변수 효율적인 미세 조정(PEFT)
추가된 매개변수의 작은 하위 집합을 훈련하여 모델을 조정하는 방법입니다.
사전 훈련
다운스트림 적응 전 광범위한 데이터에 대한 초기 대규모 모델 교육.
평가 세트
학습 후 모델 품질을 측정하는 데 사용되는 홀드아웃 데이터 세트입니다.
미세 조정
사전 훈련된 모델을 특정 작업에 맞게 조정하기 위해 도메인별 데이터에 대한 지속적인 훈련입니다.
무료 가이드에서 자세히 알아보세요
AI Training
Pseudo-Labeling and Self-Training
ELECTRA Pretraining
RoBERTa Training Recipe
See also
Self-Play
Watermarking
RAG-Fusion
Citations
Multi-Query Retrieval
Factuality
Parent-Document Retrieval
GSM8K
Previous
Mid-training
Next
Self-Play
전체 AI 용어집 찾아보기
무료 AI 가이드 모두 살펴보기