Thư viện AI miễn phí

AI trực quan hướng dẫnMiễn phí mãi mãi.

133 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

133Hướng dẫn miễn phí
1Bài hát chủ đề
~2 minMỗi hướng dẫn
~4hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

133 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI trực quan

Sự hài hòa và tổng hợp hình ảnh

Tính năng hài hòa hình ảnh sẽ tự động điều chỉnh đối tượng được dán ở nền trước để màu sắc, ánh sáng và tông màu của nó phù hợp với nền mới, làm cho vật liệu tổng hợp trông thật.

2 đọc tối thiểuĐọc
AI trực quan

SDXL và khuếch tán tầng

SDXL là mô hình chuyển văn bản thành hình ảnh có độ phân giải cao của AI ổn định, kết hợp bộ tạo cơ sở mạnh mẽ với bộ lọc, trong khi chuỗi khuếch tán xếp tầng nhiều…

2 đọc tối thiểuĐọc
AI trực quan

Thế hệ nối đất GLIGEN

GLIGEN (Tạo ngôn ngữ nối đất thành hình ảnh) cho phép bạn kiểm soát chính xác vị trí các đối tượng xuất hiện trong hình ảnh được tạo bằng cách cung cấp các hộp giới hạn mô hình…

2 đọc tối thiểuĐọc
AI trực quan

Bộ chuyển đổi T2I để điều khiển khuếch tán đa điều kiện

Tìm hiểu T2I-Adapter để điều khiển khuếch tán đa điều kiện: cách nó điều khiển Khuếch tán ổn định với các cạnh, độ sâu, tư thế và các điều kiện khác bằng cách sử dụng trọng lượng nhẹ…

2 đọc tối thiểuĐọc
AI trực quan

Đảo ngược văn bản rỗng

Đảo ngược văn bản rỗng là một kỹ thuật cho phép bạn chỉnh sửa ảnh thật bằng mô hình khuếch tán dựa trên văn bản như Khuếch tán ổn định trong khi vẫn giữ mọi thứ bạn…

2 đọc tối thiểuĐọc
AI trực quan

Điều chỉnh đa khái niệm khuếch tán tùy chỉnh

Khuếch tán tùy chỉnh là một phương pháp tinh chỉnh nhẹ giúp dạy mô hình chuyển văn bản thành hình ảnh các khái niệm cá nhân mới, chẳng hạn như con chó của bạn hoặc một chiếc ghế cụ thể, chỉ từ…

2 đọc tối thiểuĐọc
AI trực quan

Trộn tiềm ẩn và nội suy hình ảnh

Pha trộn tiềm ẩn trộn lẫn các hình ảnh bằng cách kết hợp các biểu diễn nén của chúng bên trong không gian tiềm ẩn của mô hình thay vì lấy trung bình các pixel thô.

2 đọc tối thiểuĐọc
AI trực quan

Mô hình hành động-ngôn ngữ-tầm nhìn cho robot

Các mô hình Thị giác-Ngôn ngữ-Hành động (VLA) là các mạng thần kinh lớn lấy hình ảnh camera cùng với hướng dẫn bằng văn bản và xuất trực tiếp các lệnh động cơ robot.

2 đọc tối thiểuĐọc
AI trực quan

Chính sách phổ biến để điều khiển robot

Chính sách khuếch tán áp dụng ý tưởng khử nhiễu tương tự đằng sau các trình tạo hình ảnh như Khuếch tán ổn định để điều khiển robot: thay vì dự đoán một hành động tiếp theo…

2 đọc tối thiểuĐọc
AI trực quan

Chuyển văn bản thành video thành video

Make-A-Video là hệ thống năm 2022 của Meta biến lời nhắc văn bản thành một đoạn video ngắn mà không cần đào tạo về các cặp văn bản-video được gắn nhãn.

2 đọc tối thiểuĐọc
AI trực quan

Chuỗi video hình ảnh

Imagen Video là hệ thống chuyển văn bản thành video năm 2022 của Google xây dựng một đoạn clip thông qua một chuỗi gồm bảy mô hình khuếch tán, mỗi mô hình sẽ thêm nhiều khung hình hơn hoặc nhiều độ phân giải hơn.

2 đọc tối thiểuĐọc
AI trực quan

CogVideo và CogVideoX

CogVideo (2022) là mô hình chuyển văn bản thành video mở quy mô lớn đầu tiên và CogVideoX (2024) là mô hình nguồn mở kế thừa có khả năng hơn nhiều từ Tsinghua/Zhipu AI.

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.