AI 기초
AI가 무엇인지, 시스템이 어떻게 학습하는지, 어디서 실패하는지, 그리고 과장하지 않고 주장을 판단하는 방법을 이해하세요.
무료 AI 라이브러리
117 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.
여기서 시작하세요
각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.
AI가 무엇인지, 시스템이 어떻게 학습하는지, 어디서 실패하는지, 그리고 과장하지 않고 주장을 판단하는 방법을 이해하세요.
프라이버시를 보호하고, 결과물을 확인하며, 인간의 책임을 지키면서 AI를 생산적으로 활용하세요.
직장 내 사용 사례를 평가하고, 안전한 시범 사업을 운영하며, 가치를 측정하고, 변화를 책임감 있게 전달하세요.
권리, 형평성, 거버넌스, 안전, 공익 결과를 통해 AI 시스템을 분석합니다.
실용적인 시스템 설계를 통해 언어 모델, 검색, 에이전트, 평가, 비용 및 배포 안전장치를 이해하세요.
주제 트랙
관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.
전체 라이브러리
117 의 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.
커버 곡 식별은 매우 다른 소리의 두 녹음이 실제로 동일한 기본 노래(라이브 어쿠스틱 버전, 리믹스…)인 경우를 감지합니다.
오디오 AIDDSP(미분 디지털 신호 처리)는 기존 합성기 빌딩 블록을 신경망과 융합하므로 딥 러닝을 통해 발진기를 제어할 수 있습니다.
오디오 AIVITS는 일반적인 2단계 파이프라인을 건너뛰고 훈련된 단일 시스템에서 텍스트를 원시 오디오 파형으로 직접 변환하는 텍스트 음성 변환 모델입니다.
오디오 AIFastSpeech는 한 번에 한 프레임이 아닌 전체 음성 스펙트로그램을 병렬로 생성하여 합성을 훨씬 더 빠르고 안정적으로 만듭니다.
오디오 AINaturalSpeech는 인간 수준의 음성 품질을 목표로 하는 Microsoft TTS 연구의 한 계열로, 이후 버전에서는 잠재 확산을 사용하여 풍부하고 자연스러운 음성을 생성합니다.
오디오 AI음성감정인식(SER)은 음성을 통해 화자의 감정 상태(분노, 기쁨, 슬픔, 좌절)를 감지하는 AI입니다.
오디오 AIMoshi는 엄격한 순서를 따르는 대신 전이중 방식으로 동시에 말하고 듣는 Kyutai의 오픈 소스 실시간 음성 AI입니다.
오디오 AIS2ST(음성-음성 번역)는 한 언어로 된 단어를 가져와 다른 언어로 생성합니다. 즉 화자의 목소리, 어조를 이상적으로 보존합니다.
오디오 AIHiFi-GAN은 멜 스펙트로그램을 거의 즉시 원시 오디오 파형으로 변환하여 멀리까지 스튜디오 품질의 음성을 생성하는 생성적 적대적 보코더입니다.
오디오 AI문자소-음소(G2P) 변환은 쓰여진 글자를 음성 시스템이 실제로 발음해야 하는 소리로 변환합니다.
오디오 AI텍스트 정규화는 음성 시스템이 말하기 전에 원시 서면 텍스트를 완전히 음성으로 다시 쓰는 프런트 엔드 단계입니다.
오디오 AISoundStream은 품질을 유지하면서 음성과 음악을 매우 낮은 비트 전송률로 압축하는 Google의 엔드 투 엔드 신경 오디오 코덱입니다.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.