Thư viện AI miễn phí

Tìm hiểu AI.Miễn phí mãi mãi.

1019 hướng dẫn bằng tiếng Anh đơn giản, lộ trình học tập có cấu trúc và thư viện mở — được xây dựng bởi tổ chức phi lợi nhuận 501(c)(3) độc lập để bất kỳ ai cũng có thể hiểu được AI hiện đại.

1019Hướng dẫn miễn phí
9Bài hát chủ đề
~2 minMỗi hướng dẫn
~34hThời gian đọc

Bắt đầu ở đây

Năm Các khóa học dựa trên kết quả

Mỗi khóa học bao gồm kết quả rõ ràng, năng lực được lập bản đồ, hoạt động thực hành và một bài luận ứng dụng.

Bài hát chủ đề

Duyệt theo bản nhạc

Nhảy vào lĩnh vực bạn quan tâm. Mỗi bản nhạc đều có nhiều hướng dẫn bằng tiếng Anh đơn giản.

Thư viện đầy đủ

Tất cả hướng dẫn

1019 của 1019 hướng dẫn hiển thị. Lọc theo bản nhạc hoặc tìm kiếm ở trên.

kỹ thuật

KServe và Model Serve trên Kubernetes

KServe là một nền tảng gốc Kubernetes được tiêu chuẩn hóa để phục vụ các mô hình học máy trên quy mô lớn.

2 đọc tối thiểuĐọc
kỹ thuật

Đồ thị suy luận và lõi Seldon

Seldon Core là một nền tảng nguồn mở để triển khai các mô hình machine learning trên Kubernetes, với tính năng nổi bật: đồ thị suy luận.

2 đọc tối thiểuĐọc
AI trực quan

Bộ điều hợp IP cho lời nhắc hình ảnh

Bộ chuyển đổi IP là một tiện ích bổ sung nhẹ cho phép các mô hình khuếch tán như Khuếch tán ổn định chấp nhận hình ảnh dưới dạng lời nhắc chứ không chỉ là văn bản.

2 đọc tối thiểuĐọc
AI trực quan

Chuyển văn bản thành hình ảnh

Imagen là hệ thống chuyển văn bản thành hình ảnh của Google giúp biến mô tả bằng văn bản thành hình ảnh chân thực.

2 đọc tối thiểuĐọc
AI trực quan

Mô hình khuếch tán GLIDE

GLIDE là mô hình phổ biến văn bản thành hình ảnh OpenAI sớm hiển thị lời nhắc cùng với 'hướng dẫn không cần phân loại' có thể đánh bại các hệ thống dựa trên GAN trước đó.

2 đọc tối thiểuĐọc
AI âm thanh

Tự động gắn thẻ âm nhạc

Tính năng tự động gắn thẻ âm nhạc sử dụng công nghệ máy học để nghe một bài hát và tự động đính kèm các nhãn mô tả như thể loại, tâm trạng, nhạc cụ và nhịp độ.

2 đọc tối thiểuĐọc
AI âm thanh

Chuyển âm sắc âm nhạc

Việc chuyển âm sắc sẽ định hình lại 'màu sắc âm thanh' của âm thanh để một nhạc cụ này phát ra âm thanh giống một nhạc cụ khác, biến giai điệu ngân nga thành tiếng violin hoặc kèn trumpet…

2 đọc tối thiểuĐọc
AI âm thanh

Phân loại cảnh âm thanh

Phân loại cảnh âm thanh (ASC) giúp máy nhận biết môi trường ghi âm, một con phố đông đúc, một công viên yên tĩnh, một chuyến tàu, một quán cà phê…

2 đọc tối thiểuĐọc
AI âm thanh

NVIDIA Riva và NeMo Speech

NVIDIA Riva là SDK được GPU tăng tốc dành cho AI sản xuất giọng nói (ASR, TTS và dịch thuật), trong khi NeMo là bộ công cụ nguồn mở để đào tạo và tinh chỉnh…

2 đọc tối thiểuĐọc
AI âm thanh

Kiến trúc DeepSpeech

DeepSpeech là mô hình nhận dạng giọng nói end-to-end được Baidu giới thiệu vào năm 2014, ánh xạ các tính năng âm thanh thô trực tiếp vào văn bản bằng cách sử dụng hệ thống thần kinh tái diễn…

2 đọc tối thiểuĐọc
AI âm thanh

Phần nhúng loa X-Vector

Vectơ X là dấu vân tay số có độ dài cố định của giọng nói của người nói do mạng lưới thần kinh tạo ra, được sử dụng để biết ai đang nói bất kể họ nói gì.

2 đọc tối thiểuĐọc
Ngôn ngữ AI

Truy xuất lối đi dày đặc

Truy xuất đoạn văn dày đặc (DPR) tìm thấy văn bản có liên quan bằng cách so sánh ý nghĩa của câu hỏi và đoạn văn dưới dạng vectơ số, không khớp với các từ.

2 đọc tối thiểuĐọc

Đọc xong chưa? Chứng minh đi.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.