무료 AI 라이브러리

AI를 배우세요.영원히 무료입니다.

1019 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

1019무료 가이드
9주제 트랙
~2 min가이드 당
~34h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

1019 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

기술

Kubernetes의 KServe 및 모델 서비스

KServe는 기계 학습 모델을 대규모로 제공하기 위한 표준화된 Kubernetes 기반 플랫폼입니다.

2 분 읽음읽기
기술

Seldon 코어 및 추론 그래프

Seldon Core는 추론 그래프라는 뛰어난 기능을 갖춘 Kubernetes에 기계 학습 모델을 배포하기 위한 오픈 소스 플랫폼입니다.

2 분 읽음읽기
비주얼 AI

이미지 프롬프트용 IP 어댑터

IP-Adapter는 Stable Diffusion과 같은 확산 모델이 텍스트뿐만 아니라 이미지를 프롬프트로 받아들일 수 있게 해주는 경량 추가 기능입니다.

2 분 읽음읽기
비주얼 AI

Imagen 텍스트 대 이미지

Imagen은 작성된 설명을 사실적인 그림으로 바꾸는 Google의 텍스트-이미지 시스템입니다.

2 분 읽음읽기
비주얼 AI

GLIDE 확산 모델

GLIDE는 초기 OpenAI 텍스트-이미지 확산 모델로 프롬프트와 '분류자 없는 안내'가 이전 GAN 기반 시스템을 능가할 수 있음을 보여주었습니다.

2 분 읽음읽기
오디오 AI

음악 자동 태그 지정

음악 자동 태그 지정은 기계 학습을 사용하여 노래를 듣고 장르, 분위기, 악기, 템포와 같은 설명 레이블을 자동으로 첨부합니다.

2 분 읽음읽기
오디오 AI

뮤지컬 음색 전송

음색 전송은 오디오의 '음색'을 재구성하여 한 악기가 다른 악기처럼 들리도록 하고 흥얼거리는 멜로디를 바이올린이나 트럼펫 라인으로 바꿔줍니다.

2 분 읽음읽기
오디오 AI

음향 장면 분류

음향 장면 분류(ASC)는 번잡한 거리, 조용한 공원, 기차, 카페 등 녹음이 이루어진 환경을 인식하도록 기계를 훈련시킵니다.

2 분 읽음읽기
오디오 AI

NVIDIA Riva 및 NeMo 연설

NVIDIA Riva는 프로덕션 음성 AI(ASR, TTS 및 번역)를 위한 GPU 가속 SDK인 반면, NeMo는 교육 및 미세 조정을 위한 오픈 소스 툴킷입니다.

2 분 읽음읽기
오디오 AI

딥스피치 아키텍처

DeepSpeech는 2014년 Baidu가 도입한 엔드투엔드 음성 인식 모델로, 순환 신경망을 사용하여 원시 오디오 특징을 텍스트에 직접 매핑합니다.

2 분 읽음읽기
오디오 AI

X-벡터 스피커 임베딩

X-벡터는 신경망에서 생성된 화자 음성의 고정 길이 숫자 지문으로, 말하는 내용에 관계없이 누가 말하고 있는지 알려주는 데 사용됩니다.

2 분 읽음읽기
언어 AI

조밀한 통로 검색

DPR(Dense Passage Retrieval)은 질문과 구절의 의미를 일치하는 단어가 아닌 숫자 벡터로 비교하여 관련 텍스트를 찾습니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.