Cập nhật hàng ngày2411 câu chuyện đã được xác minh
Tin tức AI. Không có tiếng ồn.
Dựa trên AI được kiểm tra nguồn về việc ra mắt sản phẩm, thay đổi chính sách, nghiên cứu an toàn và các động thái trong ngành, được giải thích bằng tiếng Anh đơn giản bởi một nhóm giáo dục phi lợi nhuận.
Nguồn cung cấp đã được xác minh
Mỗi câu chuyện đều liên kết với bằng chứng mạnh mẽ nhất hiện có: nguồn gốc khi có, các báo cáo được ghi nhận rõ ràng.
Tiếng Anh đơn giản
Điều gì đã xảy ra, tại sao nó lại quan trọng và những gì cần xem — không có biệt ngữ.
Không có phụ
Khi tín hiệu yếu, chúng tôi không xuất bản gì ngoài việc đệm nguồn cấp dữ liệu.
Thêm câu chuyện
9 câu chuyệnĐổi mới
Preprint báo cáo xếp hạng ứng viên LLM cao hơn cho các tổ chức uy tín
Một bản in trước của arXiv báo cáo rằng bốn mô hình ngôn ngữ lớn đánh giá hồ sơ ứng viên thuận lợi hơn khi được liên kết với các tổ chức và tạp chí có uy tín cao hơn. Các tác giả cho biết các dấu hiệu về thể chế và địa lý có thể định hình việc đánh giá, trong khi các mô hình được thử nghiệm và các lĩnh vực chuyên môn vẫn chưa được chỉ định trong nguồn được cung cấp.arxiv.orgĐổi mới
Nghiên cứu cho thấy bối cảnh suy luận có thể thay đổi kết quả đầu ra LLM trong các kịch bản phân bổ y tế
Một bài báo arXiv báo cáo rằng ba trong số bốn mô hình ngôn ngữ được thử nghiệm đã thay đổi xác suất phân bổ tài nguyên theo cách khác nhau khi cùng một kịch bản lâm sàng được đánh giá có hoặc không có phản hồi trước đó của mô hình trong ngữ cảnh.arxiv.orgĐổi mới
Báo cáo Preprint giải mã AI các câu tự nhiên từ bản ghi não không xâm lấn
Một nhóm nghiên cứu mô tả Brain2Qwerty v2, một mô hình sử dụng bản ghi MEG thời gian thực để giải mã các câu tự nhiên được đánh máy, báo cáo tỷ lệ lỗi từ trung bình là 39% trong chín chủ đề.arxiv.orgĐổi mới
Bản đồ nghiên cứu 46 mô hình ngôn ngữ được xây dựng cho tiếng Bồ Đào Nha
Một nghiên cứu lập bản đồ có hệ thống liệt kê 46 mô hình ngôn ngữ Bồ Đào Nha và so sánh kiến trúc, tài nguyên đào tạo, giấy phép, mã, dữ liệu và trọng số. Các tác giả cho biết lĩnh vực này đang phát triển nhưng khó đánh giá vì thông tin trải rộng trên các giấy tờ, báo cáo kỹ thuật, kho lưu trữ và tài liệu dự án.arxiv.orgĐổi mới
Nghiên cứu về khả năng diễn giải liên kết các câu trả lời quá tự tin của Qwen3-4B với cơ chế thiên vị chắc chắn
Một nghiên cứu arXiv báo cáo rằng Qwen3-4B thiên về sự chắc chắn hơn là sự không chắc chắn trong các nhiệm vụ lập luận có kiểm soát và xác định các tính năng của mô hình có thể gây ra sự mất cân bằng. Các tác giả cho biết các biện pháp can thiệp có mục tiêu đã làm giảm các lỗi quá tự tin, nhưng bản tóm tắt không tiết lộ mức độ ảnh hưởng hoặc chi tiết thử nghiệm.arxiv.orgĐổi mới
Khoảng cách Deontic: Mô hình ngôn ngữ lớn và ngôn ngữ nghĩa vụ theo phương thức
Các trợ từ khiếm khuyết như must, Should, và Have để đánh dấu sự cần thiết và nghĩa vụ trong bối cảnh quyền lực của người nói và lập trường giữa các cá nhân.arxiv.orgBảo mật
Bài viết đề xuất che giấu tín hiệu từ chối để chống lại các cuộc tấn công xóa bỏ
Bản in trước arXiv giới thiệu một phương pháp chỉnh sửa trọng lượng nhằm mục đích làm cho việc trích xuất và loại bỏ các từ chối an toàn trở nên khó khăn hơn. Bài viết báo cáo điểm từ chối sau xóa bỏ mạnh mẽ hơn trên hai mô hình mở, với sự đánh đổi khác nhau về hiệu suất cho mục đích chung.arxiv.orgĐổi mới
Bài viết báo cáo một phương pháp tạm thời để phát hiện ảo giác ở cấp độ mã thông báo
Bản in trước arXiv mô tả một máy phát hiện ảo giác kết hợp số liệu thống kê văn bản, tín hiệu kế thừa và sự ngạc nhiên của mô hình ngôn ngữ trên các chuỗi thay vì đánh giá các mã thông báo một cách độc lập. Theo bài báo, mô hình BiGRU của nó đã đạt AUC là 0,840 trên RAGTruth.arxiv.orgĐổi mới
Theo dõi thực thể xuất hiện với 410 triệu thông số, vượt xa con người trong các câu chuyện theo chủ nghĩa tự nhiên
Hiểu ngôn ngữ đòi hỏi phải theo dõi các thực thể trong diễn ngôn - tức là biết mọi thứ ở đâu và chúng thay đổi như thế nào, ngay cả khi không được nêu rõ ràng.arxiv.org
Mỗi tuần một buổi họp hữu ích
Theo dõi AI mà không sống trong nguồn tin.
Nhận tin tức AI đã được xác minh trong tuần, dữ liệu gốc, công cụ hữu ích, lựa chọn học tập và các công việc AI mới.
Tiếp cận những người đang học AI
Thuê một chuyên gia AI hay ra mắt một sản phẩm AI hữu ích? Hãy đặt nó trước những người đến đây để học hỏi và hành động.
Đăng tuyển dụng AIGửi một công cụ AI