Thư viện AI miễn phí

AI trực quan hướng dẫnMiễn phí mãi mãi.

133 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

133Hướng dẫn miễn phí
1Bài hát chủ đề
~2 minMỗi hướng dẫn
~4hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

133 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI trực quan

Nhận dạng ký tự quang học

Nhận dạng ký tự quang học (OCR) biến hình ảnh của văn bản — tài liệu được quét, ảnh biển báo, tệp PDF — thành văn bản có thể đọc được bằng máy và có thể chỉnh sửa.

2 đọc tối thiểuĐọc
AI trực quan

Dòng quang học

Luồng quang học ước tính cách mỗi pixel di chuyển giữa các khung hình video liên tiếp, tạo ra bản đồ dày đặc các vectơ chuyển động.

2 đọc tối thiểuĐọc
AI trực quan

Ước tính độ sâu bằng một mắt

Ước tính độ sâu bằng một mắt dự đoán khoảng cách giữa mỗi pixel so với một bức ảnh thông thường — không cần máy ảnh âm thanh nổi, lidar hoặc cảm biến độ sâu.

2 đọc tối thiểuĐọc
AI trực quan

Mô hình khuếch tán tiềm ẩn

Các mô hình khuếch tán tiềm ẩn tạo ra hình ảnh bằng cách chạy quy trình khuếch tán trong không gian tiềm ẩn được nén thay vì pixel thô, giúp giảm chi phí tính toán.

2 đọc tối thiểuĐọc
AI trực quan

Mạng điều khiển

ControlNet là một tiện ích bổ sung cung cấp cho các mô hình tạo hình ảnh khả năng kiểm soát cấu trúc chính xác, cho phép bạn điều khiển đầu ra bằng các cạnh, tư thế, bản đồ độ sâu hoặc nét vẽ nguệch ngoạc.

2 đọc tối thiểuĐọc
AI trực quan

Hướng dẫn không cần phân loại

Hướng dẫn không cần phân loại là kỹ thuật làm cho các mô hình khuếch tán thực sự tuân theo lời nhắc của bạn, đánh đổi sự đa dạng để có được sự tuân thủ mạnh mẽ hơn nhiều.

2 đọc tối thiểuĐọc
AI trực quan

SLAM trực quan

Visual SLAM cho phép camera chuyển động xây dựng bản đồ về một không gian không xác định đồng thời theo dõi vị trí của chính nó bên trong bản đồ đó.

2 đọc tối thiểuĐọc
AI trực quan

Sora và chuyển văn bản thành video

Sora là mô hình chuyển văn bản thành video của OpenAI biến lời nhắc bằng văn bản thành một video clip ngắn có độ phân giải cao.

2 đọc tối thiểuĐọc
AI trực quan

Mô hình khuếch tán video

Các mô hình khuếch tán video tạo ra các hình ảnh chuyển động bằng cách dần dần biến nhiễu ngẫu nhiên thành các khung hình mạch lạc, mở rộng ý tưởng khuếch tán từ hình ảnh sang thời gian.

2 đọc tối thiểuĐọc
AI trực quan

Thế hệ chuyển văn bản thành 3D

Thế hệ chuyển văn bản thành 3D biến lời nhắc bằng văn bản như 'chiếc ghế bành bọc da cổ điển' thành mô hình 3D đầy đủ mà bạn có thể xoay, chiếu sáng và thả vào trò chơi hoặc cảnh.

2 đọc tối thiểuĐọc
AI trực quan

Hiển thị khác biệt

Kết xuất có thể phân biệt làm cho quá trình biến cảnh 3D thành hình ảnh 2D có thể phân biệt hoàn toàn, do đó bạn có thể tính toán độ chuyển màu từ các pixel được kết xuất…

2 đọc tối thiểuĐọc
AI trực quan

Kiến trúc U-Net

U-Net là mạng thần kinh tích chập có hình dạng giống chữ 'U', có khả năng tạo ra kết quả đầu ra chính xác đến từng pixel, ban đầu dành cho phân đoạn hình ảnh y sinh.

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 10 of 12 | AI Understanding