Cập nhật hàng ngày2303 câu chuyện đã được xác minh
Tin tức AI. Không có tiếng ồn.
Dựa trên AI được kiểm tra nguồn về việc ra mắt sản phẩm, thay đổi chính sách, nghiên cứu an toàn và các động thái trong ngành, được giải thích bằng tiếng Anh đơn giản bởi một nhóm giáo dục phi lợi nhuận.
Nguồn cung cấp đã được xác minh
Mỗi câu chuyện đều liên kết với bằng chứng mạnh mẽ nhất hiện có: nguồn gốc khi có, các báo cáo được ghi nhận rõ ràng.
Tiếng Anh đơn giản
Điều gì đã xảy ra, tại sao nó lại quan trọng và những gì cần xem — không có biệt ngữ.
Không có phụ
Khi tín hiệu yếu, chúng tôi không xuất bản gì ngoài việc đệm nguồn cấp dữ liệu.
Thêm câu chuyện
9 câu chuyệnĐổi mới
Bài viết ArXiv đề xuất đào tạo dựa trên các mốc quan trọng cho các đại lý LLM có tầm nhìn dài hạn
MileGPO sử dụng khám phá cột mốc và bằng chứng địa phương để cải thiện việc phân công tín chỉ khi đào tạo các tác nhân mô hình ngôn ngữ về các nhiệm vụ dài, gồm nhiều bước. Các tác giả báo cáo các kết quả tiên tiến nhất trên ALFWorld và WebShop, nhưng các tuyên bố vẫn chỉ giới hạn trong các thử nghiệm của bài báo.arxiv.orgĐổi mới
Kiểm tra bản in trước xem các đại lý LLM có biết khi nào cần ghi nhớ, xác minh hoặc hỏi không
Một điểm chuẩn mới đánh giá liệu các tác nhân mô hình ngôn ngữ có quyết định chính xác khi nào nên lưu, kiểm tra, sử dụng tạm thời hoặc làm rõ thông tin có nguồn gốc từ tương tác với người dùng hay không.arxiv.orgĐổi mới
Kiểm tra tính công bằng giữa các ngôn ngữ trong hình mờ mô hình ngôn ngữ
Một khung đánh giá mới cho các sơ đồ thủy ấn trong các mô hình ngôn ngữ lớn được đề xuất, tập trung vào tính công bằng giữa các ngôn ngữ.arxiv.orgChính sách
Chỉ số AI của Stanford nhận thấy chính sách AI đang mở rộng khi chủ quyền và đầu tư phân kỳ
Chỉ số AI 2026 của Stanford HAI cho biết các chiến lược AI quốc gia đang lan rộng, trong khi các quy tắc bản địa hóa dữ liệu, năng lực tính toán do nhà nước hỗ trợ và đầu tư công vẫn không đồng đều giữa các khu vực.hai.stanford.eduĐổi mới
Điểm chuẩn AI cùng nhau: GLM-5.3 vượt qua GPT-5.6 Sol trong lần thử đầu tiên, giành chiến thắng khi thử lại với mức giá chỉ bằng một nửa
Một phân tích AI cùng nhau về 904 đợt triển khai DeepSWE báo cáo rằng GPT-5.6 Sol của GPT-5.6 dẫn đầu về độ chính xác mã hóa ở lần thử đầu tiên trong khi GLM-5.3 trọng lượng mở dẫn đầu sau khi cho phép thử lại, với chi phí gần bằng một nửa cho mỗi lần thử.together.aiĐổi mới
Preprint đề xuất một mô hình AI được mã hóa cục bộ để tạo hình chìm mờ theo chuỗi thời gian mạnh mẽ
Bản in trước arXiv đề xuất mô hình tổng hợp AI và phương pháp tạo hình mờ để có được dữ liệu chuỗi thời gian đa biến đáng tin cậy hơn sau khi chỉnh sửa. Các tác giả báo cáo các bài kiểm tra về các tiêu chuẩn tài chính, năng lượng và hình ảnh thần kinh, nhưng bản tóm tắt không đưa ra kết quả bằng số hoặc bằng chứng nào về việc triển khai.arxiv.orgĐổi mới
Truy xuất mã ngôn ngữ tự nhiên cho 1C:Enterprise: Điểm chuẩn mở và bộ mã hóa hai lớp hiệu quả
Truy xuất mã ngôn ngữ tự nhiên là một nhiệm vụ phát triển nhanh chóng trong khoa học máy tính. Tuy nhiên, hệ sinh thái 1C:Enterprise kết hợp cú pháp tiếng Nga với thuật ngữ chuyên biệt theo miền, trong đó các bộ dữ liệu mở và mô hình chuyên biệt hầu như không tồn tại.arxiv.orgĐổi mới
Truy xuất chuỗi thời gian để làm nền tảng cho các mô hình ngôn ngữ đa phương thức trong cuộc sống hữu ích còn lại
Các mô hình ngôn ngữ lớn (LLM) và hệ thống AI tác nhân đang ngày càng được khám phá cho các nhiệm vụ tiên lượng và bảo trì theo miền cụ thể, đặt ra câu hỏi liệu chúng có thể hỗ trợ tiên lượng và quản lý sức khỏe (PHM) một cách hiệu quả hay không.arxiv.orgĐổi mới
Bản in sẵn tiếng Nepal-Anh: AI chỉ có văn bản phù hợp với mô hình đa phương thức trên tiêu chuẩn thông tin sai lệch ngoài ngữ cảnh
Bản in trước arXiv mới giới thiệu NepOOC, một chuẩn mực tiếng Anh-Nepal gồm 1.090 cặp để phát hiện các chú thích gây hiểu lầm gắn liền với hình ảnh xác thực. Trên tập dữ liệu này, mô hình mBERT chỉ có văn bản phù hợp với hệ thống đa phương thức được thử nghiệm tốt nhất, trong khi các mô hình chỉ có hình ảnh hoạt động gần như ngẫu nhiên.arxiv.org
Mỗi tuần một buổi họp hữu ích
Theo dõi AI mà không sống trong nguồn tin.
Nhận tin tức AI đã được xác minh trong tuần, dữ liệu gốc, công cụ hữu ích, lựa chọn học tập và các công việc AI mới.
Tiếp cận những người đang học AI
Thuê một chuyên gia AI hay ra mắt một sản phẩm AI hữu ích? Hãy đặt nó trước những người đến đây để học hỏi và hành động.
Đăng tuyển dụng AIGửi một công cụ AI