Bezpłatna biblioteka AI

Wizualna sztuczna inteligencja przewodnikiZa darmo na zawsze.

133 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

133Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~4hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

133 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Wizualna sztuczna inteligencja

Suwaki LoRA do edycji obrazu

Suwaki LoRA to maleńkie moduły dodatkowe, które umożliwiają ciągłe wybieranie przesuwania pojedynczego atrybutu obrazu w górę lub w dół, takiego jak wiek, uśmiech czy rdza, bez…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Edycja instrukcji InstructPix2Pix

InstructPix2Pix umożliwia edycję zdjęcia poprzez wpisanie zwykłego polecenia, takiego jak „przyrządź zimę” lub „zamień kota w psa”, bez konieczności stosowania masek ani narzędzi zaznaczania.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Edycja między uwagami od monitu do monitu

Funkcja Prompt-to-Prompt edytuje wygenerowany obraz, modyfikując monit tekstowy przy jednoczesnym ponownym wykorzystaniu wewnętrznych map uwagi modelu, więc zmiana jednego słowa powoduje zamianę…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Super-rozdzielczość ESRGAN i GAN

ESRGAN wykorzystuje konkurencję między generatorem a dyskryminatorem, aby uzyskać realistyczne szczegóły podczas skalowania obrazów w górę, wykraczające poza rozmytą interpolację.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Praktyczna renowacja Real-ESRGAN

Real-ESRGAN rozszerza ESRGAN, aby obsługiwał niechlujną, nieznaną degradację rzeczywistych zdjęć, a nie czyste, syntetyczne rozmycie.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Regeneracja transformatora SwinIR

SwinIR wykorzystuje przesuniętą uwagę okna Swin Transformer do zadań przywracania obrazu, takich jak superrozdzielczość, usuwanie szumów i usuwanie artefaktów JPEG.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Modele spójności ukrytej

Modele spójności ukrytej (LCM) to technika, która pozwala generatorom obrazów dyfuzyjnych wytwarzać obrazy wysokiej jakości w zaledwie jednym do czterech krokach, a nie…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Transformatory wizji

Transformatory wizyjne (ViT) wykorzystują architekturę transformatora, która zasila ChatGPT obrazy, traktując obraz jako sekwencję poprawek, a nie siatkę…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Stable Diffusion

Stable Diffusion to model zamiany tekstu na obraz typu open source, wydany przez Stability AI w 2022 r., który generuje obrazy poprzez stopniowe usuwanie szumu z losowego…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Midjourney

Midjourney to popularna komercyjna usługa zamiany tekstu na obraz, znana z uderzających, wysoce estetycznych wyników i pochodzenia jako bot Discord.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

DALL-E

DALL-E to rodzina modeli zamiany tekstu na obraz firmy OpenAI, które przekształcają pisemny opis w oryginalny obraz.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Modele CLIP i języka wizyjnego

CLIP to model firmy OpenAI, który uczy się łączyć obrazy i tekst, umieszczając oba w tej samej przestrzeni matematycznej.

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 8 of 12 | AI Understanding