무료 AI 라이브러리

비주얼 AI 가이드영원히 무료입니다.

133 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

133무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

133 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

비주얼 AI

광학 문자 인식

광학 문자 인식(OCR)은 스캔한 문서, 표지판 사진, PDF 등 텍스트 이미지를 기계가 읽을 수 있고 편집 가능한 텍스트로 변환합니다.

2 분 읽음읽기
비주얼 AI

광학 흐름

광학 흐름은 각 픽셀이 연속 비디오 프레임 사이에서 어떻게 이동하는지 추정하여 조밀한 모션 벡터 맵을 생성합니다.

2 분 읽음읽기
비주얼 AI

단안 깊이 추정

단안 깊이 추정은 모든 픽셀이 단일 일반 사진에서 얼마나 멀리 떨어져 있는지 예측합니다. 스테레오 카메라, LiDAR 또는 깊이 센서가 필요하지 않습니다.

2 분 읽음읽기
비주얼 AI

잠재 확산 모델

잠재 확산 모델은 원시 픽셀 대신 압축된 잠재 공간에서 확산 프로세스를 실행하여 이미지를 생성하므로 컴퓨팅 비용이 대폭 절감됩니다.

2 분 읽음읽기
비주얼 AI

컨트롤넷

ControlNet은 이미지 생성 모델에 정밀한 구조 제어를 제공하는 추가 기능으로, 가장자리, 포즈, 깊이 맵 또는 낙서를 사용하여 출력을 조정할 수 있습니다.

2 분 읽음읽기
비주얼 AI

분류자 없는 안내

분류자 없는 안내는 확산 모델이 실제로 사용자의 프롬프트를 따르도록 만드는 기술로, 훨씬 더 강력한 준수를 위해 일부 다양성을 교환합니다.

2 분 읽음읽기
비주얼 AI

비주얼 슬램

Visual SLAM을 사용하면 움직이는 카메라가 알 수 없는 공간의 지도를 구축하는 동시에 해당 지도 내에서 자체 위치를 추적할 수 있습니다.

2 분 읽음읽기
비주얼 AI

Sora 및 텍스트-비디오

Sora는 서면 메시지를 짧은 고해상도 비디오 클립으로 변환하는 OpenAI의 텍스트-비디오 모델입니다.

2 분 읽음읽기
비주얼 AI

비디오 확산 모델

비디오 확산 모델은 무작위 노이즈를 점진적으로 일관성 있는 프레임으로 전환하여 움직이는 이미지를 생성하고 확산 아이디어를 사진에서 시간으로 확장합니다.

2 분 읽음읽기
비주얼 AI

텍스트-3D 생성

Text-to-3D 생성은 '빈티지 가죽 안락의자'와 같은 서면 메시지를 회전하고, 조명하고, 게임이나 장면에 넣을 수 있는 완전한 3D 모델로 전환합니다.

2 분 읽음읽기
비주얼 AI

미분 가능한 렌더링

미분 가능 렌더링은 3D 장면을 완전히 미분 가능한 2D 이미지로 변환하는 프로세스를 만들어 렌더링된 픽셀에서 그래디언트를 계산할 수 있습니다.

2 분 읽음읽기
비주얼 AI

U-Net 아키텍처

U-Net은 원래 생물 의학 이미지 분할을 위해 픽셀 단위의 정확한 출력을 생성하는 데 탁월한 'U' 모양의 컨볼루션 신경망입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.