HƯỚNG DẪN AI trực quan

CodeFormer Phục hồi khuôn mặt mạnh mẽ

CodeFormer là một mô hình khôi phục khuôn mặt được xây dựng để xử lý tình trạng xuống cấp nghiêm trọng, khôi phục các khuôn mặt có thể nhận dạng được từ dữ liệu đầu vào bị hỏng nặng, nhỏ hoặc bị mờ.

Đọc trong 2 phútCập nhật lần cuối

Tổng quan

It matters because it lets users dial the trade-off between staying faithful to the original and producing a clean, high-quality result.

Lặn sâu

CodeFormer (NeurIPS 2022) điều chỉnh việc khôi phục khuôn mặt dưới dạng dự đoán mã rời rạc thay vì hồi quy pixel liên tục. Đầu tiên, nó đào tạo một cuốn sách mã kiểu VQGAN: một từ điển nhỏ, được học về các 'khối xây dựng' khuôn mặt giúp ghi lại chi tiết khuôn mặt chất lượng cao. Với một khuôn mặt đã bị xuống cấp, Transformer dự đoán những mục nhập trong sổ mã nào sẽ tái tạo lại nó tốt nhất, xử lý việc khôi phục giống như chọn đúng mã thông báo từ vốn từ vựng của các bộ phận khuôn mặt. Bởi vì sổ mã tồn tại trong một không gian nhỏ gọn, hữu hạn nên mô hình này có khả năng chống nhiễu và mờ nghiêm trọng hơn nhiều so với các phương pháp ánh xạ trực tiếp các pixel. Mô-đun chuyển đổi tính năng có thể điều khiển được cho phép người dùng trượt một trọng lượng duy nhất (thường được gọi là độ trung thực) để ưu tiên đầu ra sắc nét hơn, chân thực hơn hoặc độ trung thực mạnh hơn đối với đầu vào bị hỏng.

Hiểu biết kỹ thuật

Sách mã rời rạc hoạt động giống như một ưu tiên mạnh mẽ với 'từ vựng' hạn chế, do đó, ngay cả khi đầu vào bị hỏng nặng, Transformer vẫn có thể đưa ra dự đoán về các mã khuôn mặt hợp lệ, chất lượng cao. Mô hình hóa toàn cầu này thông qua sự chú ý làm giảm sự phụ thuộc vào các tín hiệu pixel cục bộ mà sự xuống cấp sẽ phá hủy. Trọng số độ trung thực có thể điều chỉnh sẽ kiểm soát mức độ dựa vào các tính năng đầu vào của mạng so với sổ mã đã học, giao dịch bảo toàn danh tính với độ sạch đầu ra.

Tác động chiến lược

Tốc độ và tỷ lệ

Visual AI có thể tự động hóa các nhiệm vụ kiểm tra, phát hiện và gắn thẻ trên quy mô lớn.

Xây dựng lựa chọn

Các nhóm sáng tạo có thể tạo nguyên mẫu nhanh hơn với ít sửa đổi thủ công hơn.

Nhóm và quy trình làm việc

Các hoạt động có thể sử dụng tín hiệu hình ảnh và video mà trước đây khó xử lý.

Tương lai của CodeFormer Phục hồi khuôn mặt mạnh mẽ

Các thiết kế Codebook-plus-Transformer đang ảnh hưởng đến công việc tạo và khôi phục rộng hơn, đồng thời CodeFormer ngày càng được kết hợp với tính năng sàng lọc khuếch tán để có kết quả sắc nét hơn nữa. Mong đợi các phiên bản tạm thời tốt hơn cho video, khóa danh tính tốt hơn để quá trình khôi phục nặng nề không làm thay đổi hình dáng của một người và tích hợp chặt chẽ hơn vào các ứng dụng ảnh dành cho người tiêu dùng. Giống như tất cả các trình khôi phục khuôn mặt, tính minh bạch về chi tiết được tái tạo và các biện pháp bảo vệ chống lạm dụng sẽ ngày càng trở nên quan trọng.

Triển khai trong thế giới thực

Khôi phục khuôn mặt từ cảnh quay lưu trữ hoặc giám sát có độ phân giải cực thấp

Khôi phục các bức chân dung lịch sử bị hư hỏng nặng, bị mờ hoặc bị pixel

Sửa hình ảnh do AI tạo ra trong đó khuôn mặt bị mờ hoặc biến dạng

Cho phép người dùng điều chỉnh thanh trượt độ trung thực để lựa chọn giữa khôi phục trung thực hoặc bóng bẩy

Rủi ro & lan can

Quyền và sự đồng ý về hình ảnh có thể trở thành rủi ro pháp lý nếu nguồn gốc xuất xứ không rõ ràng.

Hiệu suất của mô hình có thể khác nhau tùy theo ánh sáng, nhân khẩu học và môi trường.

Kết quả dương tính giả có thể không được chú ý trừ khi ngưỡng tin cậy được theo dõi.

Lộ trình thực hiện

1

Xác định tiêu chí chấp nhận về độ chính xác, thu hồi và chi phí lỗi.

2

Kiểm tra với dữ liệu phù hợp với điều kiện sản xuất thực tế.

3

Thêm đánh giá của con người đối với những dự đoán có độ tin cậy thấp hoặc tác động cao.

4

Theo dõi sự trôi dạt của mô hình và xác nhận lại sau khi thay đổi máy ảnh hoặc tập dữ liệu.

Tiếp tục khám phá

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the CodeFormer Robust Face Recovery quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Bắt đầu bài kiểm tra

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Hướng dẫn tiếp theo

Độ phân giải LaMa-Inpainting mạnh mẽ

Câu hỏi thường gặp

What is CodeFormer Robust Face Recovery?

CodeFormer là một mô hình khôi phục khuôn mặt được xây dựng để xử lý tình trạng xuống cấp nghiêm trọng, khôi phục các khuôn mặt có thể nhận dạng được từ dữ liệu đầu vào bị hỏng nặng, nhỏ hoặc bị mờ. Điều này quan trọng vì nó cho phép người dùng cân bằng giữa việc trung thành với bản gốc và tạo ra kết quả rõ ràng, chất lượng cao.

Về cơ bản, CodeFormer định hình vấn đề khôi phục khuôn mặt như thế nào?

CodeFormer dự đoán các mục nhập riêng biệt từ sách mã kiểu VQGAN, xử lý quá trình khôi phục giống như chọn mã thông báo thay vì hồi quy các pixel thô.

Thành phần nào dự đoán mục nhập sổ mã nào sẽ được sử dụng?

Transformer mô hình hóa bối cảnh toàn cầu để dự đoán các mã thông báo sổ mã tốt nhất, mạnh mẽ hơn việc dựa vào các tín hiệu pixel cục bộ.

Tại sao sổ mã rời rạc lại hữu ích cho các đầu vào bị xuống cấp nghiêm trọng?

Do các dự đoán bám sát một bộ mã khuôn mặt chất lượng cao có giới hạn nên mô hình vẫn hoạt động mạnh mẽ ngay cả khi các pixel đầu vào bị hỏng nghiêm trọng.

Kiểm soát trọng lượng độ trung thực có thể điều chỉnh của CodeFormer là gì?

Việc chuyển đổi tính năng có thể kiểm soát cho phép người dùng chuyển đổi giữa việc giữ nguyên danh tính ban đầu và tạo ra kết quả rõ ràng hơn, sắc nét hơn.

CodeFormer được xuất bản ở địa điểm nào?

CodeFormer được giới thiệu tại NeurIPS 2022, trình bày phương pháp tra cứu sổ mã để phục hồi khuôn mặt hiệu quả.