무료 AI 라이브러리

기술 가이드영원히 무료입니다.

177 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

177무료 가이드
1주제 트랙
~2 min가이드 당
~6h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

177 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

기술

TensorRT 및 추론 엔진

TensorRT는 훈련된 신경망을 NVIDIA GPU에서 훨씬 빠르게 실행되는 고도로 최적화된 엔진으로 컴파일하는 NVIDIA의 라이브러리입니다.

2 분 읽음읽기
기술

Triton 추론 서버

Triton Inference Server는 대규모 프로덕션에서 AI 모델을 배포하고 제공하기 위한 NVIDIA의 오픈 소스 플랫폼입니다.

2 분 읽음읽기
기술

분산 AI를 위한 Ray

Ray는 Python 및 AI 워크로드를 노트북에서 수천 대의 머신 클러스터로 쉽게 확장할 수 있게 해주는 오픈 소스 프레임워크입니다.

2 분 읽음읽기
기술

완전히 샤딩된 데이터 병렬

FSDP(Fully Sharded Data Parallel)는 모델의 매개변수, 기울기 및 최적화 상태를 여러 GPU에 분할하는 분산 교육 기술입니다.

2 분 읽음읽기
기술

그라데이션 체크포인트

그라디언트 체크포인트(활성화 체크포인트라고도 함)는 정방향 패스 중에 대부분의 중간 활성화를 버리는 메모리 절약 트릭입니다.

2 분 읽음읽기
기술

ONNX 및 모델 상호 운용성

ONNX(Open Neural Network Exchange)는 기계 학습 모델을 표현하기 위한 개방형 표준 형식으로, 프레임워크 간에 자유롭게 이동할 수 있습니다.

2 분 읽음읽기
기술

텐서 코어

Tensor 코어는 행렬 곱셈 및 누적 작업을 매우 빠르게 수행하는 최신 NVIDIA GPU 내부의 특수 하드웨어 장치입니다.

2 분 읽음읽기
기술

고대역폭 메모리

고대역폭 메모리(HBM)는 GPU 바로 옆에 배치된 스택 메모리로 일반 RAM보다 훨씬 빠르게 데이터를 전달합니다.

2 분 읽음읽기
기술

NVLink 및 GPU 상호 연결

NVLink 및 관련 상호 연결은 많은 GPU가 서로 직접적이고 빠르게 통신할 수 있게 해주는 고속 링크입니다.

2 분 읽음읽기
기술

모델 병합

모델 병합은 두 개 이상의 훈련된 신경망의 가중치를 재훈련이나 원래 훈련에 대한 액세스 없이 단일 모델로 결합합니다.

2 분 읽음읽기
기술

혼합 및 희소 모델

Mixtral은 작은 모델 속도로 큰 모델 품질을 제공하는 Mistral AI의 개방형 전문가 혼합 모델입니다.

2 분 읽음읽기
기술

AI를 위한 GPU와 TPU

GPU와 TPU는 AI 훈련 및 실행을 위한 두 가지 주요 칩 유형입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.