무료 AI 라이브러리

오디오 AI 가이드영원히 무료입니다.

117 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

117무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

117 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

오디오 AI

빔포밍 및 마이크 어레이

빔포밍은 여러 마이크를 사용하여 선택한 방향으로 듣고 다른 모든 것을 억제하면서 대상의 소리를 증폭시킵니다.

2 분 읽음읽기
오디오 AI

확산 분광사진 확산

Riffusion은 사운드를 그림으로 처리하여 음악을 생성하는 영리한 해킹입니다. Stable Diffusion 이미지 모델을 미세 조정하여 스펙트로그램을 그린 다음…

2 분 읽음읽기
오디오 AI

MusicLM: 계층적 의미 체계 및 음향 토큰

Google MusicLM이 계층적 의미 체계 및 음향 토큰, SoundStream 및 MuLan을 사용하여 텍스트 프롬프트를 일관된 음악으로 바꾸는 방법을 알아보세요.

2 분 읽음읽기
오디오 AI

Noise2Noise 음성 향상

Noise2Noise는 노이즈가 다른 쌍으로부터 학습하여 깨끗한 참조를 보지 않고도 모델이 노이즈를 제거하는 방법을 학습할 수 있는 훈련 트릭입니다.

2 분 읽음읽기
오디오 AI

Conv-TasNet 시간 영역 분리

Conv-TasNet은 원시 사운드 파형에 직접 작업하여 혼합 오디오(두 사람이 동시에 말하는 것과 같은)를 분리하는 신경망입니다.

2 분 읽음읽기
오디오 AI

이중 경로 RNN 분리

DPRNN(Dual-Path RNN)은 매우 긴 오디오 기능 시퀀스를 짧은 중첩 청크로 분할하여 처리하는 오디오 분리 아키텍처입니다.

2 분 읽음읽기
오디오 AI

오픈-언믹스 음악 분리

UMX(Open-Unmix)는 노래를 보컬, 드럼, 베이스 및 기타 악기의 각 부분으로 분할하는 오픈 소스 딥 러닝 시스템입니다.

2 분 읽음읽기
오디오 AI

속삭임 타임스탬프가 있는 단어 정렬

속삭임 단어 정렬은 녹음된 각 단어를 오디오의 정확한 시작 및 종료 시간에 고정합니다.

2 분 읽음읽기
오디오 AI

Transformers를 사용한 음악 태깅

음악 태깅은 변환기 모델을 사용하여 노래를 듣고 장르, 분위기, 악기 및 템포와 같은 설명 레이블을 예측합니다.

2 분 읽음읽기
오디오 AI

오디오의 시작 감지

시작 감지는 오디오 신호에서 음표, 비트 또는 사운드가 시작되는 정확한 순간을 찾습니다.

2 분 읽음읽기
오디오 AI

MelGAN 생성 보코더

MelGAN은 단일 고속 전달 패스에서 멜 스펙트로그램을 원시 오디오 파형으로 변환하는 완전 컨볼루션 GAN 기반 보코더입니다.

2 분 읽음읽기
오디오 AI

UnivNet 다중 해상도 보코더

UnivNet은 다양한 STFT 해상도에서 계산된 여러 스펙트로그램을 사용하여 생성된 오디오를 판단하여 고주파수 세부 정보를 선명하게 만드는 GAN 보코더입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.