무료 AI 라이브러리

오디오 AI 가이드영원히 무료입니다.

117 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

117무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

117 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

오디오 AI

EnCodec 오디오 압축

EnCodec은 Meta의 고성능 신경 오디오 코덱으로 훨씬 더 무거운 형식에 필적하는 품질로 매우 낮은 비트 전송률로 음성과 음악을 압축합니다.

2 분 읽음읽기
오디오 AI

잔여 벡터 양자화

RVQ(잔차 벡터 양자화)는 반복적으로 양자화하여 연속 오디오 임베딩을 이산 코드의 컴팩트한 스택으로 바꾸는 기술입니다.

2 분 읽음읽기
오디오 AI

ECAPA-TDNN 화자 인식

ECAPA-TDNN은 모든 음성 클립을 컴팩트한 '성문' 임베딩으로 변환하여 기계가 누가 말하고 있는지 알 수 있도록 하는 신경망 아키텍처입니다.

2 분 읽음읽기
오디오 AI

스피커 스푸핑 방지 및 ASV 스푸핑

스푸핑 방지는 음성 인증 시스템을 속이려는 가짜 또는 재생된 음성을 탐지하는 방어 계층입니다.

2 분 읽음읽기
오디오 AI

RNNoise를 사용한 음성 잡음 제거

RNNoise는 음성에서 배경 소음을 실시간으로 제거하는 작고 빠른 신경망입니다.

2 분 읽음읽기
오디오 AI

오디오 임베딩 및 표현 학습

오디오 임베딩은 사운드를 의미를 포착하는 간단한 숫자 벡터로 변환하므로 기계는 인간이 인식하는 방식으로 오디오를 비교, 검색 및 분류할 수 있습니다.

2 분 읽음읽기
오디오 AI

음향 반향 제거

AEC(음향 반향 제거)는 통화 중에 자신의 목소리가 되돌아오는 것을 듣지 못하게 하는 기술입니다.

2 분 읽음읽기
오디오 AI

말 분리와 칵테일 파티 문제

음성 분리는 여러 사람이 동시에 말하는 녹음에서 개별 음성을 분리하는 작업입니다.

2 분 읽음읽기
오디오 AI

순열 불변 훈련

PIT(순열 불변 훈련)는 모델이 각 음성이 어떤 출력 슬롯에 도달하는지 신경 쓰지 않고 여러 음성을 분리할 수 있게 해주는 영리한 훈련 방법입니다.

2 분 읽음읽기
오디오 AI

음악정보 검색

MIR(음악 정보 검색)은 컴퓨터가 오디오 신호 및 악보에서 음악을 분석, 이해 및 검색하도록 가르치는 분야입니다.

2 분 읽음읽기
오디오 AI

Demucs 및 HT-Demucs 음악 소스 분리

Demucs 및 HT-Demucs가 파형, 스펙트로그램 및 변압기 모델링을 사용하여 음악을 보컬과 악기 줄기로 분리하는 방법을 알아보세요.

2 분 읽음읽기
오디오 AI

오디오 코드 인식

오디오 코드 인식은 오디오에서 직접 노래 전체에 걸쳐 연주되는 코드에 자동으로 레이블을 지정하는 작업입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.