무료 AI 라이브러리

비주얼 AI 가이드영원히 무료입니다.

133 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

133무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

133 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

비주얼 AI

소설관 종합

새로운 뷰 합성은 실제로 촬영된 적이 없는 시점에서 장면의 사실적인 이미지를 생성합니다.

2 분 읽음읽기
비주얼 AI

Muse Masked Generative Imaging

Muse는 마스크된 이미지 토큰을 한꺼번에 채워 그림을 생성하는 Google의 텍스트-이미지 모델로, 단계별보다 훨씬 빠릅니다.

2 분 읽음읽기
비주얼 AI

Parti Pathways 자기회귀 영상

Parti(Pathways Autoregressive Text-to-Image)는 언어 모델이 문장을 작성하는 방식으로 그림을 생성합니다. 즉, 한 번에 하나의 이미지 토큰을 생성하고 다음 토큰을 예측합니다.

2 분 읽음읽기
비주얼 AI

Imagen 2 및 보상 조정 확산

Imagen 2는 Google의 사실적인 확산 기반 텍스트-이미지 모델로, 보상 조정으로 개선되어 출력이 사람들이 실제로 원하는 것과 더 잘 일치합니다.

2 분 읽음읽기
비주얼 AI

LaMa 해상도-강력한 인페인팅

LaMa(Large Mask inpainting)는 구멍이 큰 경우에도 이미지에서 누락되거나 제거된 영역을 깔끔하게 채우는 빠르고 가벼운 신경망입니다.

2 분 읽음읽기
비주얼 AI

안정적인 영상확산

SVD(Stable Video Diffusion)는 단일 스틸 이미지를 짧고 부드럽게 움직이는 비디오 클립으로 바꾸는 Stability AI의 개방형 기반 모델입니다.

2 분 읽음읽기
비주얼 AI

뤼미에르 시공간 비디오 생성

Lumiere는 Space-Time U-Net을 사용하여 전체 비디오 클립을 한 번에 생성하는 Google Research의 텍스트-비디오 확산 모델입니다.

2 분 읽음읽기
비주얼 AI

Mip-NeRF 및 앤티앨리어싱 래디언스 필드

Mip-NeRF는 다양한 거리나 해상도에서 장면을 렌더링할 때 원본 NeRF를 괴롭히는 흐릿하고 들쭉날쭉한 아티팩트를 수정합니다.

2 분 읽음읽기
비주얼 AI

Plenoxel 및 Voxel Radiance Fields

Plenoxels는 신경망 없이도 NeRF 품질의 결과로 3D 장면을 재구성할 수 있음을 보여주었습니다. 색상을 저장하는 복셀 그리드만 있으면 됩니다.

2 분 읽음읽기
비주얼 AI

DUSt3R 고밀도 3D 재구성

DUSt3R은 알려진 카메라 위치나 보정 없이도 몇 장의 일반 사진에서 조밀한 3D 형상을 재구성합니다.

2 분 읽음읽기
비주얼 AI

Tune-A-Video 원샷 편집

Tune-A-Video는 단일 비디오에서 사전 훈련된 텍스트-이미지 확산 모델을 미세 조정하여 새로운 텍스트 프롬프트에서 해당 클립을 다시 편집할 수 있습니다.

2 분 읽음읽기
비주얼 AI

DreamFusion 및 점수 증류 샘플링

DreamFusion은 2D 이미지 확산 모델을 비평가로 사용하여 텍스트에서 3D 개체를 생성하며 3D 데이터에 대해 교육하지 않습니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 5 of 12 | AI Understanding