무료 AI 라이브러리

비주얼 AI 가이드영원히 무료입니다.

133 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

133무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

133 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

비주얼 AI

이미지 조화 및 합성

이미지 조화는 붙여넣은 전경 개체를 자동으로 조정하여 해당 색상, 조명, 톤이 새 배경과 일치하도록 하여 합성물이 실제처럼 보이도록 합니다.

2 분 읽음읽기
비주얼 AI

SDXL 및 계단식 확산

SDXL은 강력한 기본 생성기와 리파이너를 결합하는 동시에 계단식 확산 체인을 여러…

2 분 읽음읽기
비주얼 AI

GLIGEN 접지 생성

GLIGEN(Grounded-Language-to-Image Generation)을 사용하면 모델 경계 상자를 공급하여 생성된 이미지에서 객체가 나타나는 위치를 정확하게 제어할 수 있습니다.

2 분 읽음읽기
비주얼 AI

다중 조건 확산 제어를 위한 T2I 어댑터

다중 조건 확산 제어를 위한 T2I-Adapter 알아보기: 경량을 사용하여 가장자리, 깊이, 포즈 및 기타 조건으로 Stable Diffusion을 조종하는 방법…

2 분 읽음읽기
비주얼 AI

널 텍스트 반전

Null-text inversion은 Stable Diffusion과 같은 텍스트 기반 확산 모델을 사용하여 실제 사진을 편집하면서 모든 내용을 유지하는 기술입니다.

2 분 읽음읽기
비주얼 AI

맞춤형 확산 다중 개념 튜닝

Custom Diffusion은 텍스트-이미지 모델에 개나 특정 의자와 같은 새로운 개인 개념을 처음부터 가르치는 가벼운 미세 조정 방법입니다.

2 분 읽음읽기
비주얼 AI

잠재 혼합 및 이미지 보간

잠재 블렌딩은 원시 픽셀을 평균화하는 대신 모델의 잠재 공간 내에서 압축된 표현을 결합하여 이미지를 혼합합니다.

2 분 읽음읽기
비주얼 AI

로봇공학을 위한 비전-언어-행동 모델

VLA(Vision-Language-Action) 모델은 카메라 이미지와 서면 지침을 입력하고 로봇 모터 명령을 직접 출력하는 대규모 신경망입니다.

2 분 읽음읽기
비주얼 AI

로봇제어 확산정책

확산 정책은 Stable Diffusion과 같은 이미지 생성기 뒤에 있는 동일한 노이즈 제거 아이디어를 로봇 제어에 적용합니다. 즉, 단일 다음 동작을 예측하는 대신…

2 분 읽음읽기
비주얼 AI

Make-A-Video 텍스트-비디오

Make-A-Video는 라벨이 붙은 텍스트-비디오 쌍에 대한 교육 없이 텍스트 프롬프트를 짧은 비디오 클립으로 바꾸는 Meta의 2022년 시스템입니다.

2 분 읽음읽기
비주얼 AI

Imagen 비디오 캐스케이드

Imagen Video는 Google의 2022년 텍스트-비디오 시스템으로, 각각 더 많은 프레임이나 더 많은 해상도를 추가하는 7개 확산 모델의 계단식을 통해 클립을 생성합니다.

2 분 읽음읽기
비주얼 AI

CogVideo 및 CogVideoX

CogVideo(2022)는 최초의 대규모 개방형 텍스트-비디오 모델이었으며 CogVideoX(2024)는 Tsinghua/Zhipu AI의 훨씬 더 강력한 오픈 소스 후속 모델입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.