Thư viện AI miễn phí

AI âm thanh hướng dẫnMiễn phí mãi mãi.

117 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

117Hướng dẫn miễn phí
1Bài hát chủ đề
~2 minMỗi hướng dẫn
~4hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

117 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI âm thanh

Mảng chùm tia và micrô

Beamforming sử dụng nhiều micrô để nghe theo hướng đã chọn, khuếch đại âm thanh từ mục tiêu trong khi triệt tiêu mọi thứ khác.

2 đọc tối thiểuĐọc
AI âm thanh

Khuếch tán phổ khuếch tán

Riffusion là một thủ thuật thông minh giúp tạo ra âm nhạc bằng cách xử lý âm thanh như một hình ảnh: nó tinh chỉnh mô hình hình ảnh Khuếch tán ổn định để vẽ các biểu đồ phổ, sau đó…

2 đọc tối thiểuĐọc
AI âm thanh

MusicLM: Mã thông báo ngữ nghĩa và âm thanh phân cấp

Tìm hiểu cách Google MusicLM sử dụng mã thông báo âm thanh và ngữ nghĩa phân cấp, SoundStream và MuLan để biến lời nhắc văn bản thành âm nhạc mạch lạc.

2 đọc tối thiểuĐọc
AI âm thanh

Cải thiện giọng nói Noise2Noise

Noise2Noise là một thủ thuật huấn luyện cho phép mô hình học cách loại bỏ nhiễu mà không hề thấy một tham chiếu rõ ràng nào, bằng cách học từ các cặp nhiễu khác nhau…

2 đọc tối thiểuĐọc
AI âm thanh

Tách miền thời gian Conv-TasNet

Conv-TasNet là mạng thần kinh phân tách âm thanh hỗn hợp (như hai người nói chuyện cùng một lúc) bằng cách làm việc trực tiếp trên dạng sóng âm thanh thô thay vào đó…

2 đọc tối thiểuĐọc
AI âm thanh

Tách RNN đường dẫn kép

Dual-Path RNN (DPRNN) là kiến ​​trúc phân tách âm thanh giúp phân chia một chuỗi tính năng âm thanh rất dài thành các đoạn chồng chéo ngắn và xử lý chúng…

2 đọc tối thiểuĐọc
AI âm thanh

Tách nhạc mở-Unmix

Open-Unmix (UMX) là một hệ thống deep learning mã nguồn mở chia bài hát thành các phần: giọng hát, trống, bass và các nhạc cụ khác.

2 đọc tối thiểuĐọc
AI âm thanh

Căn chỉnh từ theo dấu thời gian thì thầm

Căn chỉnh từ thì thầm ghim từng từ được phiên âm vào thời gian bắt đầu và kết thúc chính xác trong âm thanh.

2 đọc tối thiểuĐọc
AI âm thanh

Gắn thẻ âm nhạc với Transformers

Gắn thẻ âm nhạc sử dụng mô hình biến áp để nghe bài hát và dự đoán các nhãn mô tả như thể loại, tâm trạng, nhạc cụ và nhịp độ.

2 đọc tối thiểuĐọc
AI âm thanh

Phát hiện khởi phát trong âm thanh

Tính năng phát hiện khởi phát tìm thấy những khoảnh khắc chính xác khi các nốt, nhịp hoặc âm thanh bắt đầu trong tín hiệu âm thanh.

2 đọc tối thiểuĐọc
AI âm thanh

Bộ mã hóa sáng tạo MelGAN

MelGAN là một bộ phát âm dựa trên GAN tích chập hoàn toàn, biến các biểu đồ phổ mel thành dạng sóng âm thanh thô chỉ trong một lần chuyển tiếp nhanh.

2 đọc tối thiểuĐọc
AI âm thanh

Bộ mã hóa đa độ phân giải UnivNet

UnivNet là một bộ mã hóa GAN đánh giá âm thanh được tạo ra bằng cách sử dụng nhiều biểu đồ phổ được tính toán ở các độ phân giải STFT khác nhau, làm sắc nét chi tiết tần số cao.

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 6 of 10 | AI Understanding