Perpustakaan AI percuma

AI Visual panduanPercuma selamanya.

133 panduan bahasa Inggeris biasa, laluan pembelajaran berstruktur dan perpustakaan terbuka — dibina oleh 501(c)(3) bukan untung bebas supaya sesiapa sahaja boleh memahami AI moden.

133Panduan percuma
1Jejak topik
~2 minSetiap panduan
~4hMasa membaca

Mulakan di sini

Lima kursus berasaskan hasil

Setiap kursus merangkumi hasil yang jelas, kompetensi yang dipetakan, aktiviti latihan, dan capstone terapan.

Jejak topik

Semak imbas mengikut trek

Lompat ke kawasan yang anda minati. Setiap trek mempunyai berbilang panduan bahasa Inggeris biasa.

Perpustakaan penuh

Semua panduan

133 daripada 1019 panduan yang ditunjukkan. Tapis mengikut trek atau carian di atas.

AI Visual

Pengharmonian dan Penggabungan Imej

Pengharmonian imej secara automatik melaraskan objek latar depan yang ditampal supaya warna, pencahayaan dan tonnya sepadan dengan latar belakang baharu, menjadikan komposit kelihatan nyata.

2 min bacaBaca
AI Visual

SDXL dan Resapan Lata

SDXL ialah model teks-ke-imej beresolusi tinggi Stability AI yang menggandingkan penjana asas yang berkuasa dengan penapisan, manakala rantaian resapan berlatarkan berbilang…

2 min bacaBaca
AI Visual

GLIGEN Grounded Generation

GLIGEN (Grounded-Language-to-Image Generation) membolehkan anda mengawal dengan tepat di mana objek muncul dalam imej yang dijana dengan menyuap kotak sempadan model…

2 min bacaBaca
AI Visual

Penyesuai T2I untuk Kawalan Resapan Berbilang Syarat

Ketahui T2I-Adapter untuk kawalan resapan berbilang syarat: cara ia mengemudi Resapan Stabil dengan tepi, kedalaman, pose dan keadaan lain menggunakan…

2 min bacaBaca
AI Visual

Penyongsangan Null-Teks

Penyongsangan teks nul ialah teknik yang membolehkan anda mengedit foto sebenar dengan model resapan dipacu teks seperti Stable Diffusion sambil mengekalkan semua yang anda…

2 min bacaBaca
AI Visual

Penalaan Berbilang Konsep Resapan Tersuai

Penyebaran Tersuai ialah kaedah penalaan halus ringan yang mengajar model teks kepada imej konsep peribadi baharu, seperti anjing anda atau kerusi tertentu, dari hanya…

2 min bacaBaca
AI Visual

Pengadunan Terpendam dan Interpolasi Imej

Pengadunan terpendam mencampurkan imej dengan menggabungkan perwakilan termampatnya di dalam ruang terpendam model dan bukannya purata piksel mentah.

2 min bacaBaca
AI Visual

Model Visi-Bahasa-Tindakan untuk Robotik

Model Vision-Language-Action (VLA) ialah rangkaian saraf besar yang mengambil imej kamera ditambah arahan bertulis dan mengeluarkan arahan motor robot secara langsung.

2 min bacaBaca
AI Visual

Dasar Penyebaran untuk Kawalan Robot

Dasar Resapan menggunakan idea denosing yang sama di sebalik penjana imej seperti Resapan Stabil kepada kawalan robot: bukannya meramalkan satu tindakan seterusnya…

2 min bacaBaca
AI Visual

Buat-A-Video Teks-ke-Video

Make-A-Video ialah sistem 2022 Meta yang menukar gesaan teks menjadi klip video pendek tanpa pernah melatih pasangan teks-video berlabel.

2 min bacaBaca
AI Visual

Lata Video Imej

Video Imagen ialah sistem teks-ke-video Google 2022 yang membina klip melalui lata tujuh model resapan, setiap satu menambah lebih banyak bingkai atau lebih banyak peleraian.

2 min bacaBaca
AI Visual

CogVideo dan CogVideoX

CogVideo (2022) ialah model teks-ke-video terbuka berskala besar pertama, dan CogVideoX (2024) ialah pengganti sumber terbuka yang jauh lebih berkebolehan daripada Tsinghua/Zhipu AI.

2 min bacaBaca

Sudah habis membaca? Buktikan.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.