AI 기초
AI가 무엇인지, 시스템이 어떻게 학습하는지, 어디서 실패하는지, 그리고 과장하지 않고 주장을 판단하는 방법을 이해하세요.
무료 AI 라이브러리
117 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.
여기서 시작하세요
각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.
AI가 무엇인지, 시스템이 어떻게 학습하는지, 어디서 실패하는지, 그리고 과장하지 않고 주장을 판단하는 방법을 이해하세요.
프라이버시를 보호하고, 결과물을 확인하며, 인간의 책임을 지키면서 AI를 생산적으로 활용하세요.
직장 내 사용 사례를 평가하고, 안전한 시범 사업을 운영하며, 가치를 측정하고, 변화를 책임감 있게 전달하세요.
권리, 형평성, 거버넌스, 안전, 공익 결과를 통해 AI 시스템을 분석합니다.
실용적인 시스템 설계를 통해 언어 모델, 검색, 에이전트, 평가, 비용 및 배포 안전장치를 이해하세요.
주제 트랙
관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.
전체 라이브러리
117 의 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.
DiffWave는 멜 스펙트로그램에 따라 반복적으로 무작위 노이즈를 파형으로 제거하여 오디오를 합성하는 확산 기반 보코더입니다.
오디오 AIBark는 음성뿐만 아니라 웃음, 한숨, 음악 및 사운드 효과를 텍스트 프롬프트에서 직접 생성하는 Suno의 오픈 소스 텍스트-오디오 모델입니다.
오디오 AITortoise TTS는 오픈 소스 텍스트 음성 변환 시스템으로, 유난히 자연스럽고 감정적으로 풍부한 음성과 단 몇 개의 짧은 음성에서 강력한 음성 복제로 유명합니다.
오디오 AIXTTS는 짧은 클립에서 음성을 복제한 다음 보존하면서 다양한 언어로 말할 수 있는 Coqui의 다국어 텍스트 음성 변환 모델입니다.
오디오 AISoundStorm은 한 번에 하나의 토큰이 아닌 음성과 사운드를 병렬로 생성하여 고품질 오디오 합성을 만드는 Google 오디오 생성 모델입니다.
오디오 AIAudioGen은 텍스트 설명을 '새가 지저귀는 동안 개 짖는 소리'와 같은 현실적인 환경 소리 및 음향 효과로 바꾸는 Meta 모델입니다.
오디오 AIStable Audio는 잠재 확산을 사용하여 음악과 사운드 효과를 생성하고 클립 길이를 명시적으로 제어하는 Stability AI의 텍스트-오디오 시스템입니다.
오디오 AIKaldi는 음성 인식 시스템 구축을 위한 주요 연구 플랫폼이 된 무료 오픈 소스 툴킷입니다.
오디오 AIWav2Letter는 회선 신경망만 사용하고 재발이 없는 Facebook AI의 엔드투엔드 음성 인식 시스템입니다.
오디오 AIJasper와 QuartzNet은 NVIDIA의 엔드투엔드 컨볼루셔널 음성 인식 모델이며, QuartzNet은 훨씬 더 작고 효율적으로 재설계된 모델입니다.
오디오 AI확산 모델은 단계별 소음 프로세스를 역전시키는 방법을 학습하여 무작위 소음을 일관된 음성, 음악 또는 음향 효과로 변환하여 오디오를 생성합니다.
오디오 AISED(사운드 이벤트 감지)는 오디오 스트림에서 어떤 소리가 발생하는지, 그리고 소리가 시작되고 중지되는 정확한 시간을 식별합니다.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.