Perpustakaan AI gratis

AI visual panduanGratis selamanya.

133 panduan berbahasa Inggris sederhana, jalur pembelajaran terstruktur, dan perpustakaan terbuka — dibuat oleh lembaga nonprofit 501(c)(3) independen sehingga siapa pun dapat memahami AI modern.

133Panduan gratis
1Trek topik
~2 minSesuai panduan
~4hReading time

Mulai di sini

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Trek topik

Jelajahi berdasarkan trek

Lompatlah ke area yang Anda minati. Setiap trek memiliki beberapa panduan berbahasa Inggris.

Perpustakaan lengkap

Semua panduan

133 dari 1019 panduan yang ditampilkan. Filter berdasarkan trek atau cari di atas.

AI visual

Harmonisasi dan Pengomposisian Gambar

Harmonisasi gambar secara otomatis menyesuaikan objek latar depan yang ditempel sehingga warna, pencahayaan, dan nadanya sesuai dengan latar belakang baru, sehingga komposit terlihat nyata.

2 min bacaBaca
AI visual

SDXL dan Difusi Bertingkat

SDXL adalah model teks-ke-gambar resolusi tinggi Stability AI yang memasangkan generator dasar yang kuat dengan penghalus, sementara rantai difusi berjenjang…

2 min bacaBaca
AI visual

Generasi Beralas GLIGEN

GLIGEN (Grounded-Language-to-Image Generation) memungkinkan Anda mengontrol secara tepat di mana objek muncul dalam gambar yang dihasilkan dengan memasukkan kotak pembatas model…

2 min bacaBaca
AI visual

Adaptor T2I untuk Kontrol Difusi Multi-Kondisi

Pelajari Adaptor T2I untuk kontrol difusi multi-kondisi: cara mengarahkan Difusi Stabil dengan tepian, kedalaman, pose, dan kondisi lainnya menggunakan…

2 min bacaBaca
AI visual

Inversi Null-Teks

Inversi teks nol adalah teknik yang memungkinkan Anda mengedit foto asli dengan model difusi berbasis teks seperti Difusi Stabil sambil menjaga semua…

2 min bacaBaca
AI visual

Penyetelan Multi-Konsep Difusi Kustom

Difusi Kustom adalah metode penyesuaian ringan yang mengajarkan konsep pribadi baru pada model teks-ke-gambar, seperti anjing atau kursi tertentu, hanya dari…

2 min bacaBaca
AI visual

Pencampuran Laten dan Interpolasi Gambar

Pencampuran laten memadukan gambar dengan menggabungkan representasi terkompresinya di dalam ruang laten model, bukan membuat rata-rata piksel mentah.

2 min bacaBaca
AI visual

Model Visi-Bahasa-Tindakan untuk Robotika

Model Vision-Language-Action (VLA) adalah jaringan saraf besar yang mengambil gambar kamera ditambah instruksi tertulis dan langsung mengeluarkan perintah motor robot.

2 min bacaBaca
AI visual

Kebijakan Difusi untuk Pengendalian Robot

Kebijakan Difusi menerapkan gagasan penolakan yang sama di balik generator gambar seperti Difusi Stabil pada kontrol robot: alih-alih memprediksi satu tindakan selanjutnya…

2 min bacaBaca
AI visual

Buat-A-Video Teks-ke-Video

Make-A-Video adalah sistem Meta tahun 2022 yang mengubah perintah teks menjadi klip video pendek tanpa pernah melatih pasangan teks-video berlabel.

2 min bacaBaca
AI visual

Kaskade Video Gambar

Imagen Video adalah sistem teks-ke-video Google tahun 2022 yang membuat klip melalui rangkaian tujuh model difusi, yang masing-masing menambahkan lebih banyak bingkai atau lebih banyak resolusi.

2 min bacaBaca
AI visual

CogVideo dan CogVideoX

CogVideo (2022) adalah model teks-ke-video terbuka berskala besar pertama, dan CogVideoX (2024) adalah penerus sumber terbuka yang jauh lebih mumpuni dari Tsinghua/Zhipu AI.

2 min bacaBaca

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.