Cập nhật hàng ngày1797 câu chuyện đã được xác minh

Tin tức AI.Không có tiếng ồn.

Dựa trên AI được kiểm tra nguồn về việc ra mắt sản phẩm, thay đổi chính sách, nghiên cứu an toàn và các động thái trong ngành, được giải thích bằng tiếng Anh đơn giản bởi một nhóm giáo dục phi lợi nhuận.

Nguồn cung cấp đã được xác minh

Mỗi câu chuyện đều liên kết với bằng chứng mạnh mẽ nhất hiện có: nguồn gốc khi có, các báo cáo được ghi nhận rõ ràng.

Tiếng Anh đơn giản

Điều gì đã xảy ra, tại sao nó lại quan trọng và những gì cần xem — không có biệt ngữ.

Không có phụ

Khi tín hiệu yếu, chúng tôi không xuất bản gì ngoài việc đệm nguồn cấp dữ liệu.

Lưu trữ tin tức

Kho lưu trữ tin tức AI — Trang 128

Các câu chuyện về AI đã được kiểm tra nguồn, mới nhất trước tiên, dành cho những người cần hiểu về AI mà không cần theo đuổi sự cường điệu.

Source-page capture accompanying BanglaVeilGuard tests safety gaps across six forms of BanglaCâu chuyện hàng đầu
Bảo mật7 min đọc
Bảo mật7 min đọc

BanglaVeilGuard kiểm tra các lỗ hổng an toàn trên sáu dạng Bangla

Một bài báo mới giới thiệu BanglaVeilGuard, một trình bảo vệ nhắc nhở chuẩn và nhẹ được thiết kế để kiểm tra các mô hình ngôn ngữ Bangla trên các dạng tiêu chuẩn, La Mã hóa, hỗn hợp mã, ồn ào và phương ngữ. Các tác giả báo cáo tỷ lệ thành công của cuộc tấn công thấp hơn đáng kể trong đánh giá của họ, nhưng cũng nhận thấy rằng người bảo vệ đã từ chối quá mức một số hành vi lành tính…

Đọc truyện Nguồn đã được xác minh: arxiv.org
9 câu chuyện
  1. Đổi mới5 min đọc

    Điểm chuẩn ChemDIRT phát hiện các thay đổi về hiệu suất LLM hóa học bằng lời nhắc và biểu diễn phân tử

    Điểm chuẩn arXiv mới đánh giá các mô hình ngôn ngữ lớn tập trung vào hóa học thông qua các hướng dẫn khác nhau, biểu diễn phân tử và tám danh mục nhiệm vụ, báo cáo độ nhạy nhanh chóng đáng kể, sự phụ thuộc vào biểu diễn và hiệu suất không đồng đều.

    arxiv.org
  2. Công nghiệp6 min đọc

    American Bazaar đưa tin Kita huy động được 4,5 triệu USD để mở rộng đánh giá tín dụng AI

    American Bazaar báo cáo rằng Kita đã huy động được vòng hạt giống trị giá 4,5 triệu đô la do BoxGroup và Y Combinator dẫn đầu để mở rộng đánh giá tín dụng do AI cung cấp cho người cho vay. Công ty cho biết công nghệ của họ được sử dụng ở một số thị trường và đã xử lý khối lượng khoản vay hơn 130 triệu USD, nhưng những tuyên bố hoạt động đó không…

    americanbazaaronline.com
  3. Đổi mới5 min đọc

    Nghiên cứu cho thấy đường ống LLM có thể duy trì giá trị về mặt cấu trúc trong khi chất lượng bằng chứng xấu đi

    Bản in trước giới thiệu Độ tin cậy trạng thái bằng chứng, một thước đo để kiểm tra xem bằng chứng trung gian có còn sử dụng được hay không khi quy trình mô hình ngôn ngữ xử lý đầu vào bị suy giảm. Trong một đánh giá được kiểm soát bằng cách sử dụng GLM-5.2, kết quả đầu ra hợp lệ với trình phân tích cú pháp vẫn tồn tại trong khi thành công ở giai đoạn giảm.

    arxiv.org
  4. Bảo mật5 min đọc

    Điểm chuẩn của 53 mô hình AI cho thấy không có hệ thống nào nắm bắt được mọi rủi ro về nội dung có hại

    Một nghiên cứu mới của arXiv đánh giá 53 mô hình ngôn ngữ trên 11 bộ dữ liệu về an toàn và báo cáo rằng điểm mạnh của mô hình thay đổi mạnh mẽ tùy theo danh mục tác hại, trong khi vấn đề an toàn trong hội thoại vẫn chưa được giải quyết.

    arxiv.org
  5. Đổi mới5 min đọc

    Bài viết đề xuất học tăng cường hai cấp độ cho tác nhân đàm thoại

    ToSCA đề xuất một khung học tập củng cố theo cấp bậc nhằm tách biệt các lựa chọn chiến lược khỏi việc tạo phản hồi ở cấp độ mã thông báo. Các tác giả báo cáo việc lựa chọn chiến lược và chất lượng phản hồi đã được cải thiện dựa trên một số đường cơ sở trong các cuộc trò chuyện hàng ngày và hỗ trợ tinh thần.

    arxiv.org
  6. Doanh nghiệp6 min đọc

    Fortune báo cáo chi tiêu của doanh nghiệp cho Claude Fable 5 của Anthropic đã bị đình trệ

    Báo cáo của Fortune, trích dẫn dữ liệu bộ xử lý thanh toán từ Ramp, rằng Claude Fable 5 chiếm 11% chi tiêu của công ty cho các mẫu Anthropic hai tháng sau khi phát hành, nhưng tỷ lệ đó đã bị đình trệ kể từ đó. Báo cáo cho biết mô hình này có thể gây áp lực cho các công ty AI hàng đầu cạnh tranh mạnh mẽ hơn về giá, mặc dù Ramp…

    fortune.com
  7. Đổi mới5 min đọc

    Nghiên cứu báo cáo 'RAG sụp đổ' khi các mô hình ngôn ngữ lấy lại văn bản của chính họ

    Một nghiên cứu arXiv báo cáo rằng các hệ thống mô hình ngôn ngữ có thể rơi vào dạng lỗi khi tìm kiếm truy xuất các tài liệu mà chúng đã tạo trước đó. Trong mô phỏng của tác giả, 79,6% trong số 1.528 lần chạy đã kết thúc trong tình trạng mà bài báo gọi là “sự sụp đổ của RAG”.

    arxiv.org

Mỗi tuần một buổi họp hữu ích

Theo dõi AI mà không sống trong nguồn tin.

Nhận tin tức AI đã được xác minh trong tuần, dữ liệu gốc, công cụ hữu ích, lựa chọn học tập và các công việc AI mới.

Send me
One email a week. Switch any time.

Tiếp cận những người đang học AI

Thuê một chuyên gia AI hay ra mắt một sản phẩm AI hữu ích? Hãy đặt nó trước những người đến đây để học hỏi và hành động.

Đăng tuyển dụng AI Gửi một công cụ AI