무료 AI 라이브러리

오디오 AI 가이드영원히 무료입니다.

117 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

117무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

117 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

오디오 AI

노래 음성 합성

SVS(가창 음성 합성)는 쓰여진 멜로디와 가사를 완전히 노래하는 보컬 퍼포먼스로 바꾸는 AI입니다.

2 분 읽음읽기
오디오 AI

오디오LM

AudioLM은 소리를 언어처럼 처리하고 토큰을 예측하여 사실적인 오디오(말 또는 피아노 음악)를 생성하는 Google 연구 프레임워크입니다.

2 분 읽음읽기
오디오 AI

뮤직젠

MusicGen은 텍스트 설명과 선택적으로 흥얼거리거나 업로드하는 멜로디로부터 음악을 생성하는 Meta의 AI 모델입니다.

2 분 읽음읽기
오디오 AI

키워드 발견 및 깨우기 단어

키워드 발견은 기기가 'Siri야' 또는 'Alexa'와 같은 단일 트리거 문구를 기다리게 한 후 실행되도록 하는 항상 청취하는 기술입니다.

2 분 읽음읽기
오디오 AI

강제 정렬

강제 정렬은 알려진 대본과 오디오를 자동으로 정렬하여 각 단어나 소리가 시작하고 끝나는 시점을 정확하게 표시합니다.

2 분 읽음읽기
오디오 AI

멜 스펙트로그램

멜 스펙트로그램은 시간에 따른 소리의 그림으로, 인간의 귀가 음조를 인식하는 방식과 같은 간격으로 주파수를 표시합니다.

2 분 읽음읽기
오디오 AI

연결주의자의 시간 분류

CTC(Connectionist Temporal Classification)는 신경망이 긴 오디오 시퀀스를 텍스트로 변환할 수 있게 해주는 손실 함수 및 디코딩 방법입니다.

2 분 읽음읽기
오디오 AI

RNN-변환기 모델

RNN-T(RNN-Transducer)는 CTC의 가장 큰 약점인 종속성을 모델링할 수 없다는 문제를 해결하는 스트리밍 친화적인 음성 인식 아키텍처입니다.

2 분 읽음읽기
오디오 AI

컨포머 아키텍처

Conformer는 컨볼루션과 self-attention을 융합하여 세밀한 로컬 사운드 패턴과 장거리 컨텍스트를 모두 캡처하는 신경망 블록입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.