Diperbarui setiap hari2303 cerita terverifikasi
Berita AI. Tanpa kebisingan.
Liputan AI yang diperiksa sumber tentang peluncuran produk, perubahan kebijakan, riset keselamatan, dan langkah industri, dijelaskan dengan bahasa sederhana oleh tim edukasi nirlaba.
Sumber terverifikasi
Setiap cerita terhubung ke bukti terkuat yang tersedia: sumber asli jika tersedia, dan laporan yang jelas dikaitkan dengan jelas.
Bahasa Inggris Biasa
Apa yang terjadi, mengapa hal itu penting, dan apa yang harus diperhatikan — tanpa jargon.
Tidak ada pengisi
Ketika sinyalnya tipis, kami tidak mempublikasikan apa pun selain mengisi feed.
Lebih banyak cerita
9 ceritaInovasi
Makalah ArXiv mengusulkan pelatihan berbasis pencapaian untuk agen LLM jangka panjang
MileGPO menggunakan penemuan pencapaian dan bukti lokal untuk meningkatkan penugasan kredit saat melatih agen model bahasa pada tugas multi-langkah yang panjang. Para penulis melaporkan hasil-hasil mutakhir di ALFWorld dan WebShop, namun klaim tersebut tetap terbatas pada eksperimen makalah tersebut.arxiv.orgInovasi
Tes pracetak apakah agen LLM mengetahui kapan harus mengingat, memverifikasi, atau bertanya
Tolok ukur baru mengevaluasi apakah agen model bahasa dengan tepat memutuskan kapan informasi yang diturunkan dari interaksi harus disimpan, diperiksa, digunakan sementara, atau diklarifikasi dengan pengguna.arxiv.orgInovasi
Mengaudit Keadilan Lintas Bahasa dalam Watermarking Model Bahasa
Kerangka evaluasi baru untuk skema watermarking dalam model bahasa besar diusulkan, dengan fokus pada keadilan lintas bahasa.arxiv.orgKebijakan
Stanford AI Index menemukan bahwa kebijakan AI berkembang seiring dengan perbedaan kedaulatan dan investasi
Indeks AI Stanford HAI tahun 2026 menunjukkan bahwa strategi AI nasional semakin menyebar, sementara aturan lokalisasi data, kapasitas komputasi yang didukung negara, dan investasi publik masih tidak merata di seluruh wilayah.hai.stanford.eduInovasi
Tolok ukur AI bersama: GLM-5.3 tertinggal dari GPT-5.6 Sol pada percobaan pertama, menang pada percobaan ulang dengan setengah harga
Analisis Together AI terhadap peluncuran 904 DeepSWE melaporkan bahwa OpenAI GPT-5.6 Sol unggul dalam akurasi pengkodean percobaan pertama sedangkan GLM-5.3 bobot terbuka unggul setelah percobaan ulang diperbolehkan, dengan biaya kira-kira setengah dari biaya per percobaan.together.aiInovasi
Preprint mengusulkan model AI yang diberi token secara lokal untuk watermarking deret waktu yang kuat
Pracetak arXiv mengusulkan model generatif AI dan metode watermarking untuk data deret waktu multivariat yang lebih andal setelah diedit. Penulis melaporkan pengujian di bidang keuangan, energi, dan neuroimaging, namun abstraknya tidak memberikan hasil numerik atau bukti penerapannya.arxiv.orgInovasi
Pengambilan Kode Bahasa Alami untuk 1C:Enterprise: Tolok Ukur Terbuka dan Bi-Encoder yang Efisien
Pengambilan kode bahasa alami adalah tugas yang berkembang pesat dalam ilmu komputer. Namun, ekosistem 1C:Enterprise menggabungkan sintaksis Rusia dengan terminologi yang sangat spesifik untuk domain, sehingga kumpulan data terbuka dan model khusus hampir tidak ada.arxiv.orgInovasi
Pengambilan Rangkaian Waktu untuk Mendasarkan Model Bahasa Multimodal dalam Sisa Masa Bermanfaat
Model bahasa besar (LLM) dan sistem AI agen semakin banyak dieksplorasi untuk tugas pemeliharaan dan prognostik khusus domain, sehingga menimbulkan pertanyaan apakah keduanya dapat secara efektif mendukung prognostik dan manajemen kesehatan (PHM).arxiv.orgInovasi
Pracetak Nepal-Inggris: AI hanya teks yang cocok dengan model multimodal pada tolok ukur misinformasi di luar konteks
Pracetak arXiv baru memperkenalkan NepOOC, tolok ukur Nepal-Inggris dengan 1.090 pasang untuk mendeteksi teks menyesatkan yang dilampirkan pada gambar asli. Pada kumpulan data ini, model mBERT hanya teks cocok dengan sistem multimodal yang paling baik diuji, sementara model hanya gambar memiliki kinerja yang nyaris tidak terduga.arxiv.org
Satu pengarahan berguna setiap minggu
Ikuti AI tanpa harus hidup di feed.
Dapatkan berita AI terverifikasi minggu ini, data asli, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.
Jangkau orang-orang yang sedang mempelajari AI
Menyewa profesional AI atau meluncurkan produk AI yang berguna? Tunjukkan kepada orang-orang yang datang ke sini untuk belajar dan bertindak.
Posting pekerjaan AIKirim alat AI