Thư viện AI miễn phí

AI trực quan hướng dẫnMiễn phí mãi mãi.

133 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

133Hướng dẫn miễn phí
1Bài hát chủ đề
~2 minMỗi hướng dẫn
~4hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

133 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI trực quan

Đường ống chuyển văn bản thành 3D Magic3D

Magic3D là câu trả lời hai giai đoạn của NVIDIA cho DreamFusion, tạo ra nội dung 3D có độ phân giải cao hơn, chi tiết hơn nhanh hơn.

2 đọc tối thiểuĐọc
AI trực quan

Mạng khử nhiễu và khử nhiễu

Mạng khử nhiễu và khử mờ là các mô hình thần kinh giúp loại bỏ các hình ảnh nhiễu hoặc mờ, khôi phục chi tiết sắc nét từ các đầu vào lộn xộn.

2 đọc tối thiểuĐọc
AI trực quan

Phục hồi khuôn mặt GFPGAN

GFPGAN là mô hình chuyên dụng giúp khôi phục những bức ảnh khuôn mặt cũ, mờ hoặc chất lượng thấp thành những bức chân dung sắc nét, chân thực.

2 đọc tối thiểuĐọc
AI trực quan

CodeFormer Phục hồi khuôn mặt mạnh mẽ

CodeFormer là một mô hình khôi phục khuôn mặt được xây dựng để xử lý tình trạng xuống cấp nghiêm trọng, khôi phục các khuôn mặt có thể nhận dạng được từ dữ liệu đầu vào bị hỏng nặng, nhỏ hoặc bị mờ.

2 đọc tối thiểuĐọc
AI trực quan

Máy phát điện quy mô GigaGAN

GigaGAN là một GAN có hàng tỷ thông số chứng minh rằng các mạng đối thủ tổng hợp có thể mở rộng quy mô để tạo văn bản thành hình ảnh, cạnh tranh với các mô hình phổ biến…

2 đọc tối thiểuĐọc
AI trực quan

Tổng hợp hình ảnh VQGAN và Codebook

VQGAN nén hình ảnh thành một mạng lưới các mã thông báo riêng biệt được rút ra từ sách mã đã học, cho phép máy biến áp tạo ra hình ảnh giống như cách mô hình ngôn ngữ…

2 đọc tối thiểuĐọc
AI trực quan

Giải mã mã thông báo song song MaskGIT

MaskGIT tạo hình ảnh bằng cách dự đoán nhiều mã thông báo cùng một lúc và điền vào những mã thông báo đáng tin cậy nhất trước tiên, thay thế việc tạo từ trái sang phải chậm…

2 đọc tối thiểuĐọc
AI trực quan

Khuếch tán chế độ xem tiểu thuyết từ 0 đến 3

Zero-1-to-3 biến một bức ảnh của một vật thể thành hình ảnh của cùng vật thể đó được nhìn từ bất kỳ góc độ mới nào, sử dụng mô hình khuếch tán được điều chỉnh trên máy ảnh…

2 đọc tối thiểuĐọc
AI trực quan

Đại diện 3D lai DMTet

DMTet (Tứ diện Deep Marching) là một biểu diễn hình dạng 3D lai kết hợp lưới tứ diện có thể biến dạng với trường khoảng cách đã ký để thần kinh…

2 đọc tối thiểuĐọc
AI trực quan

Mã hóa băm tức thì-NGP

Instant-NGP là kỹ thuật của NVIDIA giúp đào tạo Trường bức xạ thần kinh và các nguyên hàm đồ họa thần kinh khác trong vài giây thay vì hàng giờ bằng cách lưu trữ…

2 đọc tối thiểuĐọc
AI trực quan

Độ sâuBất cứ thứ gìĐộ sâu một mắt

DepthAnything là mô hình nền tảng ước tính khoảng cách giữa mỗi pixel với một bức ảnh thông thường mà không cần phần cứng đặc biệt.

2 đọc tối thiểuĐọc
AI trực quan

Ước tính độ sâu khuếch tán cúc vạn thọ

Marigold tái sử dụng mô hình khuếch tán tạo hình ảnh đã được huấn luyện trước (Khuếch tán ổn định) để dự đoán bản đồ độ sâu có độ chi tiết cao.

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.