Thư viện AI miễn phí

Tìm hiểu AI.Miễn phí mãi mãi.

1019 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

1019Hướng dẫn miễn phí
9Bài hát chủ đề
~2 minMỗi hướng dẫn
~34hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

1019 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI trực quan

Lấy mẫu chưng cất điểm và DreamFusion

DreamFusion tạo các đối tượng 3D từ văn bản bằng cách sử dụng mô hình khuếch tán hình ảnh 2D làm nhà phê bình, không bao giờ đào tạo về bất kỳ dữ liệu 3D nào.

2 đọc tối thiểuĐọc
AI trực quan

Đường ống chuyển văn bản thành 3D Magic3D

Magic3D là câu trả lời hai giai đoạn của NVIDIA cho DreamFusion, tạo ra nội dung 3D có độ phân giải cao hơn, chi tiết hơn nhanh hơn.

2 đọc tối thiểuĐọc
Ngôn ngữ AI

Mô hình cấp byte không có tokenizer

Các mô hình không có mã thông báo sẽ loại bỏ vốn từ vựng cố định của các từ và hoạt động trực tiếp trên các byte thô, cho phép một mô hình xử lý bất kỳ ngôn ngữ, mã nào hoặc thậm chí là nhiễu…

2 đọc tối thiểuĐọc
Ngôn ngữ AI

Vectơ chức năng và biểu diễn nhiệm vụ

Vectơ hàm là các hướng nhỏ gọn bên trong các trạng thái ẩn của mô hình ngôn ngữ mã hóa toàn bộ tác vụ, như 'dịch sang tiếng Pháp' hoặc 'trả về từ trái nghĩa.

2 đọc tối thiểuĐọc
Ngôn ngữ AI

Lấy mẫu và xếp hạng lại tốt nhất

Lấy mẫu tốt nhất trong N tạo ra một số câu trả lời ứng viên từ một mô hình và sau đó chọn câu trả lời tốt nhất bằng cách sử dụng một bước tính điểm riêng.

2 đọc tối thiểuĐọc
AI âm thanh

Khuếch tán phong cách StyleTTS 2

StyleTTS 2 là mô hình chuyển văn bản thành giọng nói xử lý 'phong cách' giọng nói - giai điệu, cảm xúc và âm sắc của người nói - như một biến ngẫu nhiên được lấy mẫu bằng mô hình khuếch tán…

2 đọc tối thiểuĐọc
AI âm thanh

TTS có thể điều khiển cao độ FastPitch

FastPitch là mô hình chuyển văn bản thành giọng nói nhanh, không tự động hồi phục, dự đoán rõ ràng cao độ (tần số cơ bản) của mọi mã thông báo đầu vào, cho phép bạn…

2 đọc tối thiểuĐọc
AI âm thanh

Tạo giọng nói khớp với luồng hộp thoại

Hộp thoại là mô hình tạo giọng nói hướng dẫn bằng văn bản của Meta được đào tạo với mục tiêu khớp luồng để 'lấp đầy' âm thanh bị che, cho phép một mô hình thực hiện giọng nói không cần nói…

2 đọc tối thiểuĐọc
kỹ thuật

SmoothQuant và Lượng tử hóa kích hoạt

SmoothQuant là một kỹ thuật giúp nén các mô hình ngôn ngữ lớn xuống số nguyên 8 bit cho cả trọng số và kích hoạt mà không…

2 đọc tối thiểuĐọc
kỹ thuật

Cắt tỉa có cấu trúc và bỏ lớp

Việc cắt tỉa có cấu trúc sẽ loại bỏ toàn bộ các thành phần của mạng lưới thần kinh, chẳng hạn như đầu chú ý, nơ-ron hoặc toàn bộ lớp, do đó mô hình mỏng hơn sẽ chạy nhanh hơn…

2 đọc tối thiểuĐọc
kỹ thuật

Truyền phát đầu cơ và dự đoán nhiều mã thông báo

Luồng suy đoán và dự đoán nhiều mã thông báo tăng tốc việc tạo mô hình ngôn ngữ bằng cách đoán một số mã thông báo trong tương lai cùng một lúc và xác minh chúng trong một…

2 đọc tối thiểuĐọc
Công ty

OpenAI GPT-4.5 và GPT-5

GPT-4.5 và GPT-5 là các mô hình ngôn ngữ lớn hàng đầu của OpenAI hỗ trợ ChatGPT và API của nó.

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.