Thư viện AI miễn phí

AI âm thanh hướng dẫnMiễn phí mãi mãi.

117 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

117Hướng dẫn miễn phí
1Bài hát chủ đề
~2 minMỗi hướng dẫn
~4hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

117 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI âm thanh

Chú thích âm thanh

Chú thích âm thanh tạo ra một câu bằng ngôn ngữ tự nhiên mô tả nội dung của đoạn âm thanh, chẳng hạn như "tiếng còi tàu vang lên khi nó đi qua đường ngang".

2 đọc tối thiểuĐọc
AI âm thanh

Nhận dạng giọng nói thì thầm

Whisper là hệ thống nhận dạng giọng nói tự động nguồn mở của OpenAI giúp chuyển âm thanh thành văn bản trên hơn 90 ngôn ngữ.

2 đọc tối thiểuĐọc
AI âm thanh

Wav2Vec 2.0

Wav2Vec 2.0 là Meta mô hình giọng nói tự giám sát của AI, học cách trình bày âm thanh mạnh mẽ từ các bản ghi âm thô, không gắn nhãn.

2 đọc tối thiểuĐọc
AI âm thanh

Bài phát biểu tự giám sát của HuBERT

HuBERT (Hidden-Unit BERT) là Meta mô hình giọng nói tự giám sát của AI học bằng cách dự đoán các đơn vị âm thanh được phân cụm cho các phân đoạn bị che, kiểu BERT.

2 đọc tối thiểuĐọc
AI âm thanh

Bộ phát âm thần kinh

Bộ phát âm thần kinh là một mô hình biến biểu diễn âm thanh nhỏ gọn, thường là biểu đồ mel, thành dạng sóng âm thanh thực tế.

2 đọc tối thiểuĐọc
AI âm thanh

Bộ giải mã âm thanh thần kinh

Bộ giải mã âm thanh thần kinh sử dụng công nghệ học sâu để nén âm thanh thành các luồng mã thông báo rời rạc nhỏ và tái tạo lại âm thanh đó với độ trung thực cao.

2 đọc tối thiểuĐọc
AI âm thanh

Mô hình ngôn ngữ VALL-E và Codec

VALL-E đã định dạng lại văn bản thành giọng nói như một vấn đề mô hình hóa ngôn ngữ trên mã thông báo codec âm thanh, cho phép sao chép giọng nói chỉ từ ba giây của một mẫu.

2 đọc tối thiểuĐọc
AI âm thanh

OpenAI Thì thầm

Whisper là hệ thống nhận dạng giọng nói tự động nguồn mở của OpenAI giúp phiên âm và dịch âm thanh giọng nói qua hàng chục ngôn ngữ.

2 đọc tối thiểuĐọc
AI âm thanh

Phiên âm nhạc tự động

Phiên âm nhạc tự động (AMT) chuyển đổi bản ghi âm thô của nhạc thành ký hiệu tượng trưng như bản nhạc, MIDI hoặc cuộn piano.

2 đọc tối thiểuĐọc
AI âm thanh

Theo dõi nhịp và nhịp độ

Theo dõi nhịp và nhịp độ là nhiệm vụ tìm ra nhịp đập ổn định trong âm nhạc: vị trí mỗi nhịp rơi và tốc độ bài hát di chuyển theo nhịp mỗi phút (BPM).

2 đọc tối thiểuĐọc
AI âm thanh

Dấu vân tay âm thanh

Dấu vân tay âm thanh tạo ra chữ ký số nhỏ gọn, chống ồn của âm thanh để có thể nhận dạng âm thanh sau này, ngay cả khi có tiếng ồn xung quanh…

2 đọc tối thiểuĐọc
AI âm thanh

máy hát tự động

Jukebox là mạng thần kinh năm 2020 của OpenAI tạo ra âm thanh nhạc thô — hoàn chỉnh với giọng hát, nhạc cụ và thậm chí cả lời bài hát theo phong cách cụ thể…

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.