Thư viện AI miễn phí

AI trực quan hướng dẫnMiễn phí mãi mãi.

133 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

133Hướng dẫn miễn phí
1Bài hát chủ đề
~2 minMỗi hướng dẫn
~4hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

133 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

AI trực quan

Trường bức xạ thần kinh

Trường bức xạ thần kinh (NeRF) tái tạo lại cảnh 3D đầy đủ từ một số ảnh thông thường, cho phép bạn điều khiển máy ảnh đến các góc nhìn hoàn toàn mới.

2 đọc tối thiểuĐọc
AI trực quan

Sự bắn tung tóe Gaussian

Gaussian Splatting thể hiện cảnh 3D dưới dạng hàng triệu đốm màu nhỏ, có màu, bán trong suốt có thể được hiển thị trong thời gian thực.

2 đọc tối thiểuĐọc
AI trực quan

Bộ mã hóa tự động đeo mặt nạ

Bộ mã hóa tự động đeo mặt nạ (MAE) là một phương pháp tự giám sát giúp dạy mô hình thị giác tái tạo lại hình ảnh sau khi hầu hết hình ảnh đã bị ẩn.

2 đọc tối thiểuĐọc
AI trực quan

Chú thích hình ảnh

Chú thích hình ảnh là nhiệm vụ tự động tạo ra một câu bằng ngôn ngữ tự nhiên mô tả nội dung trong hình ảnh.

2 đọc tối thiểuĐọc
AI trực quan

Trả lời câu hỏi trực quan

Trả lời câu hỏi trực quan (VQA) cho phép hệ thống trả lời các câu hỏi bằng ngôn ngữ tự nhiên dạng tự do về một hình ảnh, chẳng hạn như 'Có bao nhiêu người đang đội mũ?

2 đọc tối thiểuĐọc
AI trực quan

YOLO Phát hiện thời gian thực

YOLO (Bạn chỉ nhìn một lần) là một nhóm các mô hình phát hiện đối tượng có chức năng tìm và gắn nhãn cho mọi đối tượng trong hình ảnh chỉ bằng một lần truyền mạng thần kinh, đủ nhanh…

2 đọc tối thiểuĐọc
AI trực quan

Phân đoạn toàn cảnh

Phân đoạn toàn cảnh cung cấp cho mỗi pixel trong hình ảnh một nhãn, thống nhất 'vùng này là gì' với 'đối tượng cụ thể này là gì'.

2 đọc tối thiểuĐọc
AI trực quan

Ước tính tư thế con người

Ước tính tư thế con người phát hiện vị trí của các khớp trên cơ thể, chẳng hạn như khuỷu tay, đầu gối và vai, để xây dựng bộ xương kỹ thuật số của một người từ hình ảnh…

2 đọc tối thiểuĐọc
AI trực quan

Mô hình hình ảnh FLUX

FLUX là một nhóm mô hình chuyển văn bản thành hình ảnh mở của Black Forest Labs nổi tiếng với chi tiết sắc nét, theo dõi lời nhắc mạnh mẽ và văn bản được hiển thị chính xác đến mức đáng ngạc nhiên.

2 đọc tối thiểuĐọc
AI trực quan

Mạng dư

Mạng dư (ResNet) là mạng thần kinh sâu có thêm chức năng 'bỏ qua kết nối' cho phép các lớp học những điều chỉnh nhỏ thay vì chuyển đổi hoàn toàn.

2 đọc tối thiểuĐọc
AI trực quan

CNN theo khu vực

CNN dựa trên khu vực (R-CNN) là một nhóm máy dò tìm đối tượng trước tiên đề xuất các vùng ứng cử viên trong hình ảnh, sau đó sử dụng CNN để phân loại và đóng hộp chính xác…

2 đọc tối thiểuĐọc
AI trực quan

Máy biến áp quay

Swin Transformer là một Vision Transformer xử lý hình ảnh trong các cửa sổ có thứ bậc, dịch chuyển, giúp sự chú ý đủ hiệu quả để mở rộng quy mô trên…

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 9 of 12 | AI Understanding