AI knihovna zdarma

Vizuální AI průvodciNavždy zdarma.

133 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

133Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

133 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Vizuální AI

Harmonizace a skládání obrazu

Harmonizace obrazu automaticky upraví vložený objekt v popředí tak, aby jeho barva, osvětlení a tón odpovídaly novému pozadí, takže kompozice vypadají skutečně.

2 min přečtenoPřečtěte si
Vizuální AI

SDXL a kaskádová difúze

SDXL je model Stability AI pro převod textu na obrázek s vysokým rozlišením, který spojuje výkonný základní generátor s upřesňovačem, zatímco kaskádové difúzní řetězce více…

2 min přečtenoPřečtěte si
Vizuální AI

GLIGEN Uzemněná generace

GLIGEN (Grounded-Language-to-Image Generation) vám umožňuje přesně řídit, kde se objekty objeví ve vygenerovaném obrázku tím, že naplní ohraničující rámečky modelu…

2 min přečtenoPřečtěte si
Vizuální AI

T2I-Adaptér pro vícepodmíněné řízení difúze

Naučte se T2I-Adapter pro vícepodmíněné ovládání difuze: jak řídí stabilní difuzi s hranami, hloubkou, pózou a dalšími podmínkami pomocí lehkého…

2 min přečtenoPřečtěte si
Vizuální AI

Inverze nulového textu

Inverze nulového textu je technika, která vám umožní upravit skutečnou fotografii pomocí textově řízeného modelu difúze, jako je Stable Diffusion, a přitom zachovat vše, co…

2 min přečtenoPřečtěte si
Vizuální AI

Vlastní difúzní multikoncepční ladění

Custom Diffusion je lehká metoda jemného doladění, která učí model text-to-image novým osobním konceptům, jako je váš pes nebo konkrétní křeslo, jen...

2 min přečtenoPřečtěte si
Vizuální AI

Latentní prolínání a obrazová interpolace

Latentní prolnutí míchá obrazy kombinováním jejich komprimovaných reprezentací uvnitř latentního prostoru modelu spíše než průměrováním nezpracovaných pixelů.

2 min přečtenoPřečtěte si
Vizuální AI

Modely vidění-jazyk-akce pro robotiku

Modely Vision-Language-Action (VLA) jsou velké neuronové sítě, které pořizují snímky z kamer plus písemné instrukce a přímo vydávají příkazy motoru robota.

2 min přečtenoPřečtěte si
Vizuální AI

Zásady šíření pro řízení robotů

Diffusion Policy aplikuje stejnou myšlenku odšumování za generátory obrázků, jako je Stable Diffusion, na ovládání robota: namísto předpovídání jediné další akce…

2 min přečtenoPřečtěte si
Vizuální AI

Make-A-Video Text-to-Video

Make-A-Video je systém Meta pro rok 2022, který přemění textovou výzvu na krátký videoklip, aniž byste museli trénovat na párech text-video.

2 min přečtenoPřečtěte si
Vizuální AI

Video kaskády Imagen

Imagen Video je systém převodu textu na video od Google z roku 2022, který vytváří klip v kaskádě sedmi difúzních modelů, z nichž každý přidává více snímků nebo větší rozlišení.

2 min přečtenoPřečtěte si
Vizuální AI

CogVideo a CogVideoX

CogVideo (2022) byl první rozsáhlý model s otevřeným textem na video a CogVideoX (2024) je jeho mnohem schopnější open-source nástupce od Tsinghua/Zhipu AI.

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.