무료 AI 라이브러리

비주얼 AI 가이드영원히 무료입니다.

133 누구나 최신 AI를 이해할 수 있도록 독립적인 501(c)(3) 비영리 단체에서 구축한 일반 영어 가이드, 구조화된 학습 경로 및 개방형 라이브러리입니다.

133무료 가이드
1주제 트랙
~2 min가이드 당
~4h읽기 시간

여기서 시작하세요

다섯 결과 기반 강좌

각 과정에는 명확한 성과, 매핑된 역량, 실습 활동, 그리고 적용된 캡스톤이 포함되어 있습니다.

주제 트랙

트랙별로 찾아보기

관심 있는 영역으로 뛰어들어 보세요. 모든 트랙에는 여러 개의 일반 영어 가이드가 있습니다.

전체 라이브러리

모든 가이드

133 1019 가이드가 표시됩니다. 트랙별로 필터링하거나 위에서 검색하세요.

비주얼 AI

신경 복사장

NeRF(Neural Radiance Fields)는 몇 장의 일반 사진에서 전체 3D 장면을 재구성하여 카메라를 완전히 새로운 시점으로 이동할 수 있게 해줍니다.

2 분 읽음읽기
비주얼 AI

가우스 스플래팅

Gaussian Splatting은 3D 장면을 실시간으로 렌더링할 수 있는 수백만 개의 작고 색상이 지정된 반투명 덩어리로 나타냅니다.

2 분 읽음읽기
비주얼 AI

마스크된 자동 인코더

MAE(Masked Autoencoders)는 대부분의 그림이 숨겨진 후 이미지를 재구성하도록 비전 모델을 가르치는 자체 감독 방법입니다.

2 분 읽음읽기
비주얼 AI

이미지 캡션

이미지 캡션은 사진 속 내용을 설명하는 자연어 문장을 자동으로 생성하는 작업입니다.

2 분 읽음읽기
비주얼 AI

시각적 질문 답변

시각적 질문 응답(VQA)을 통해 시스템은 '모자를 쓰고 있는 사람은 몇 명입니까?'와 같은 이미지에 대한 자유 형식의 자연어 질문에 답할 수 있습니다.

2 분 읽음읽기
비주얼 AI

YOLO 실시간 감지

YOLO(You Only Look Once)는 단일 신경망 패스를 사용하여 이미지의 모든 객체를 찾아 레이블을 지정하는 객체 감지 모델 제품군입니다.

2 분 읽음읽기
비주얼 AI

Panoptic 분할

Panoptic 분할은 이미지의 모든 단일 픽셀에 라벨을 부여하여 '이 영역은 무엇인가'와 '특정 객체는 무엇인가'를 통합합니다.

2 분 읽음읽기
비주얼 AI

인간 자세 추정

인간 자세 추정은 팔꿈치, 무릎, 어깨 등 신체 관절의 위치를 ​​감지하여 이미지로부터 사람의 디지털 골격을 구축합니다.

2 분 읽음읽기
비주얼 AI

FLUX 이미지 모델

FLUX는 선명한 디테일, 강력한 프롬프트 따르기, 놀랍도록 정확한 렌더링 텍스트로 유명한 Black Forest Labs의 개방형 텍스트-이미지 모델 제품군입니다.

2 분 읽음읽기
비주얼 AI

잔여 네트워크

ResNets(Residual Networks)는 레이어가 전체 변환 대신 작은 조정을 학습할 수 있도록 '연결 건너뛰기'를 추가하는 심층 신경망입니다.

2 분 읽음읽기
비주얼 AI

지역 기반 CNN

R-CNN(지역 기반 CNN)은 먼저 이미지에서 후보 영역을 제안한 다음 CNN을 사용하여 분류하고 정확하게 상자에 표시하는 객체 감지기 제품군입니다.

2 분 읽음읽기
비주얼 AI

스윈 트랜스포머

Swin Transformer는 이동된 계층적 창에서 이미지를 처리하여 전체 범위에 걸쳐 확장할 수 있을 만큼 주의를 효율적으로 만드는 비전 변환기입니다.

2 분 읽음읽기

다 읽었어? 증명해 봐.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.