Thấm nhuần các tác nhân lý luận
Imbue là tác nhân xây dựng phòng thí nghiệm AI có thể suy luận, viết mã và hành động đủ mạnh để được tin cậy thực hiện các nhiệm vụ thực tế.
Tổng quan
Điều này quan trọng vì độ tin cậy — không chỉ là trí tuệ thô — chính là nút thắt ngăn cản các tác nhân AI thực hiện công việc nhiều bước hữu ích mà không có sự giám sát liên tục.
Lặn sâu
Imbue, trước đây gọi là General Intelligence, được lãnh đạo bởi Giám đốc điều hành Kanjun Qiu và huy động được hơn 200 triệu đô la vào năm 2023 với mức định giá khoảng một tỷ đô la, được hỗ trợ bởi các nhà đầu tư bao gồm Nvidia. Thay vì theo đuổi mô hình lớn nhất có thể, Imbue tập trung vào các đại lý có lý luận đáng tin cậy và có thể xác minh công việc của chính họ. Công ty nổi tiếng đã đào tạo một mô hình 70 tỷ tham số ngay từ đầu trên cụm máy tính của riêng mình và xuất bản các ghi chú kỹ thuật chi tiết bất thường về trải nghiệm. Nghiên cứu của nó nhấn mạnh đến lý luận, tính chắc chắn và các công cụ cho phép các đặc vụ kiểm tra xem hành động của họ có thực sự thành công hay không. Mục tiêu dài hạn là các tác nhân AI cá nhân mà mọi người có thể tin tưởng để xử lý các nhiệm vụ sau đó, với sự nhấn mạnh rõ ràng vào cơ quan người dùng và khả năng xác minh thay vì tự động hóa không rõ ràng.
Hiểu biết kỹ thuật
Imbue đặt cược rằng các tác nhân lý luận cần phải được kiểm chứng chứ không chỉ thông thạo. Điều đó có nghĩa là tạo ra các bước trung gian, thực thi lệnh gọi mã hoặc công cụ, quan sát kết quả thực và tự sửa khi một hành động không thành công — đóng vòng lặp thay vì tạo ra câu trả lời nghe có vẻ hợp lý trong một lần. Quá trình đào tạo 70B ngay từ đầu của họ một phần là về việc kiểm soát toàn bộ ngăn xếp để họ có thể tối ưu hóa cụ thể cho lý do cẩn thận, có thể kiểm tra được thay vì dựa vào mô hình nền tảng chung.
Tác động chiến lược
Chiến lược nhà cung cấp
Lộ trình của nhà cung cấp ảnh hưởng đến những tính năng mà nhóm của bạn có thể xây dựng tiếp theo.
Chi phí và ngân sách
Các điều khoản thương mại và các lựa chọn triển khai ảnh hưởng đến chi phí và rủi ro dài hạn.
Rủi ro và an toàn
Các biện pháp khuyến khích của công ty định hình các tình trạng vỡ nợ của sản phẩm, trạng thái an toàn và tính cởi mở.
Tương lai của các tác nhân lý luận thấm nhuần
Biên giới dành cho các tổng đài viên đang chuyển từ các câu trả lời một lần sang độ tin cậy lâu dài: các tổng đài viên lập kế hoạch, hành động qua nhiều bước, khắc phục lỗi và biết khi nào nên hỏi con người. Mong đợi sự chú trọng nhiều hơn đến việc xác minh, sử dụng công cụ hộp cát và tính minh bạch để người dùng có thể kiểm tra những gì đại lý đã làm. Nếu các phòng thí nghiệm như Imbue thành công, các đại lý cá nhân đáng tin cậy có thể xử lý các công việc nghiên cứu, mã hóa và hành chính, nhưng phần khó khăn vẫn là tránh những sai lầm tự tin trong các hành động dẫn đến hậu quả.
Triển khai trong thế giới thực
Một tác nhân viết mã, chạy bộ thử nghiệm, đọc các lỗi và sửa các lỗi của chính nó trước khi bàn giao lại công việc.
Trợ lý nghiên cứu chia một yêu cầu mơ hồ thành các câu hỏi phụ, thu thập bằng chứng và xác minh từng phát hiện thay vì đoán mò.
Người đại diện cá nhân soạn thảo và điều chỉnh một kế hoạch gồm nhiều bước phức tạp, đánh dấu những điểm chưa chắc chắn và cần có sự phê duyệt của con người.
Công cụ nội bộ cho phép tác nhân xác nhận xem mỗi hành động có thực sự thay đổi trạng thái hệ thống hay không, thay vì giả định thành công.
Rủi ro & lan can
Thông báo ra mắt có thể vượt xa sự ổn định trong quy trình sản xuất thực tế.
Việc định giá API hoặc thay đổi chính sách có thể phá vỡ các giả định chỉ sau một đêm.
Sự phụ thuộc vào một nhà cung cấp làm tăng chi phí khóa và di chuyển.
Lộ trình thực hiện
Đánh giá các nhà cung cấp bằng cách sử dụng các nhiệm vụ và bộ dữ liệu của riêng bạn.
Xem lại các điều khoản về quyền riêng tư, bảo mật và pháp lý trước khi tích hợp.
Duy trì kế hoạch dự phòng giữa các mô hình hoặc nhà cung cấp.
Theo dõi ghi chú phát hành để những thay đổi về lộ trình không gây ngạc nhiên cho các nhóm.
Tiếp tục khám phá
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Imbue Reasoning Agents quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Hướng dẫn tiếp theo
Đại lý trải nghiệm khách hàng Sierra AI
Câu hỏi thường gặp
Imbue Reasoning Agents là gì?
Imbue là tác nhân xây dựng phòng thí nghiệm AI có thể suy luận, viết mã và hành động đủ mạnh để được tin cậy thực hiện các nhiệm vụ thực tế. Điều này quan trọng vì độ tin cậy — không chỉ trí thông minh thô — là nút thắt cổ chai ngăn cản các tác nhân AI thực hiện công việc gồm nhiều bước hữu ích mà không có sự giám sát liên tục.
Imbue trước đây được gọi là gì?
Imbue trước đây được gọi là Thông minh chung trước khi đổi thương hiệu.
Imbue cho rằng điểm nghẽn chính đối với các tác nhân AI hữu ích là gì?
Imbue nhấn mạnh rằng các đại lý phải suy luận một cách đáng tin cậy và xác minh công việc của họ để được tin cậy thực hiện các nhiệm vụ thực tế.
Imbue đã ghi lại thành tựu kỹ thuật đáng chú ý nào?
Imbue đã đào tạo mô hình tham số 70B ngay từ đầu và xuất bản các ghi chú chi tiết về công việc cơ sở hạ tầng.
Việc một đại lý 'đóng vòng lặp' có nghĩa là gì?
Đóng vòng lặp có nghĩa là thực hiện một hành động, kiểm tra kết quả thực tế và sửa lỗi nếu hành động đó thất bại.
Công ty phần cứng lớn nào nằm trong số những người ủng hộ Imbue?
Nvidia là một trong những nhà đầu tư vào vòng cấp vốn năm 2023 của Imbue.