무료 AI 라이브러리

언어 AI 가이드영원히 무료입니다.

155 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

155무료 가이드
1주제 트랙
~2 min가이드 당
~5h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

155 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

언어 AI

직접 선호도 최적화

DPO(Direct Preference Optimization)는 별도의 보상 모델을 훈련하거나 실행하지 않고도 언어 모델을 인간의 선호도에 맞추는 방법입니다.

2 분 읽음읽기
언어 AI

보상 모델링

보상 모델은 AI 반응이 얼마나 좋은지 예측하도록 훈련된 신경망으로, 인간 판단을 위한 자동화된 대리인 역할을 합니다.

2 분 읽음읽기
언어 AI

근접 정책 최적화

PPO(Proximal Policy Optimization)는 인간 피드백을 통해 언어 모델을 미세 조정하는 것과 가장 관련이 있는 강화 학습 알고리즘입니다.

2 분 읽음읽기
언어 AI

빔 검색

빔 검색은 탐욕스럽게 하나에 커밋하는 대신 각 단계에서 가장 유망한 여러 부분 시퀀스를 유지하는 디코딩 전략입니다.

2 분 읽음읽기
언어 AI

핵 및 Top-k 샘플링

Nucleus(top-p) 및 top-k 샘플링은 선택할 수 있는 토큰을 제한하여 텍스트 생성에 제어된 무작위성을 추가하는 디코딩 방법입니다.

2 분 읽음읽기
언어 AI

마스크된 언어 모델링

마스크된 언어 모델링은 AI가 왼쪽과 오른쪽의 전체 주변 컨텍스트를 사용하여 의도적으로 숨겨진 단어를 채우도록 가르칩니다.

2 분 읽음읽기
언어 AI

다음 토큰 예측

다음 토큰 예측은 GPT 스타일 모델 뒤에 있는 믿을 수 없을 정도로 간단한 목표입니다. 지금까지의 모든 것을 고려하여 다음 텍스트 덩어리를 추측합니다.

2 분 읽음읽기
언어 AI

시퀀스-투-시퀀스 모델

시퀀스-시퀀스 모델은 문장 번역이나 문서 요약과 같이 한 시퀀스를 길이가 다른 다른 시퀀스에 매핑합니다.

2 분 읽음읽기
언어 AI

인코더-디코더 아키텍처

인코더-디코더 아키텍처는 모델을 두 부분으로 나눕니다. 하나는 입력을 읽고 풍부한 내부 표현으로 압축하는 것이고, 다른 하나는…

2 분 읽음읽기
언어 AI

교차주의

교차 주의는 한 시퀀스가 다른 시퀀스를 볼 수 있게 하는 메커니즘입니다. 텍스트를 생성하는 디코더는 인코더의 입력 표현에 주의를 기울일 수 있습니다.

2 분 읽음읽기
언어 AI

치명적인 망각

치명적인 망각은 신경망이 새로운 작업을 학습하고 이미 숙달한 작업을 수행하는 능력을 갑자기 상실하는 경우입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Language AI AI Guides — Page 13 of 13 | AI Understanding