무료 AI 라이브러리

비주얼 AI 가이드영원히 무료입니다.

133 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

133무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

133 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

비주얼 AI

Magic3D 텍스트-3D 파이프라인

Magic3D는 DreamFusion에 대한 NVIDIA의 2단계 솔루션으로, 더 높은 해상도와 더 자세한 3D 콘텐츠를 더 빠르게 제작합니다.

2 분 읽음읽기
비주얼 AI

노이즈 제거 및 디블러링 네트워크

노이즈 제거 및 흐림 제거 네트워크는 노이즈가 있거나 흐릿한 이미지를 정리하고 지저분한 입력에서 선명한 세부 정보를 복구하는 신경 모델입니다.

2 분 읽음읽기
비주얼 AI

GFPGAN 얼굴 복원

GFPGAN은 품질이 낮거나 흐릿하거나 오래된 얼굴 사진을 선명하고 사실적인 인물 사진으로 복원하는 전문 모델입니다.

2 분 읽음읽기
비주얼 AI

CodeFormer 강력한 얼굴 복구

CodeFormer는 심하게 손상되었거나 작거나 흐릿한 입력에서 인식 가능한 얼굴을 복구하여 극심한 성능 저하를 처리하도록 제작된 얼굴 복원 모델입니다.

2 분 읽음읽기
비주얼 AI

GigaGAN 확장 생성기

GigaGAN은 생성적 적대 네트워크가 확산 모델에 필적하는 텍스트-이미지 생성으로 확장될 수 있음을 입증하는 10억 매개변수 GAN입니다.

2 분 읽음읽기
비주얼 AI

VQGAN 및 코드북 이미지 합성

VQGAN은 학습된 코드북에서 가져온 개별 토큰의 그리드로 이미지를 압축하여 변환기가 언어 모델과 동일한 방식으로 이미지를 생성할 수 있도록 합니다.

2 분 읽음읽기
비주얼 AI

MaskGIT 병렬 토큰 디코딩

MaskGIT는 한 번에 많은 토큰을 예측하고 가장 확실한 토큰을 먼저 채우는 방식으로 이미지를 생성하며 왼쪽에서 오른쪽으로 느린 생성을 대체합니다.

2 분 읽음읽기
비주얼 AI

0-1-3 소설 뷰 확산

Zero-1-to-3은 카메라의 확산 모델을 사용하여 물체의 단일 사진을 새로운 각도에서 본 동일한 물체의 이미지로 바꿉니다.

2 분 읽음읽기
비주얼 AI

DMTet 하이브리드 3D 표현

DMTet(Deep Marching Tetrahedra)는 변형 가능한 사면체 그리드와 서명된 거리 필드를 결합하여 신경학적으로…

2 분 읽음읽기
비주얼 AI

인스턴트 NGP 해시 인코딩

Instant-NGP는 학습 가능한 데이터를 저장하여 몇 시간이 아닌 몇 초 만에 Neural Radiance Fields 및 기타 신경 그래픽 프리미티브를 훈련시키는 NVIDIA의 기술입니다.

2 분 읽음읽기
비주얼 AI

DepthAnything 단안 깊이

DepthAnything은 특별한 하드웨어 없이 모든 픽셀이 하나의 일반 사진에서 얼마나 멀리 떨어져 있는지 추정하는 기반 모델입니다.

2 분 읽음읽기
비주얼 AI

메리골드 확산 깊이 추정

Marigold는 사전 훈련된 이미지 생성 확산 모델(Stable Diffusion)을 재활용하여 매우 상세한 깊이 맵을 예측합니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.