Diperbarui setiap hari1866 cerita terverifikasi

Berita AI. Tanpa kebisingan.

Liputan AI yang diperiksa sumber tentang peluncuran produk, perubahan kebijakan, riset keselamatan, dan langkah industri, dijelaskan dengan bahasa sederhana oleh tim edukasi nirlaba.

Sumber terverifikasi

Setiap cerita terhubung ke bukti terkuat yang tersedia: sumber asli jika tersedia, dan laporan yang jelas dikaitkan dengan jelas.

Bahasa Inggris Biasa

Apa yang terjadi, mengapa hal itu penting, dan apa yang harus diperhatikan — tanpa jargon.

Tidak ada pengisi

Ketika sinyalnya tipis, kami tidak mempublikasikan apa pun selain mengisi feed.

9 cerita
  1. KeamananKeamanan7 min membaca

    Paper Mengatakan Agen AI yang Berkembang Sendiri Dapat Mengubah Kesuksesan yang Tidak Aman Menjadi Keterampilan yang Dapat Digunakan Kembali

    Pracetak arXiv baru menandai mode kegagalan agen tertentu: ketika agen yang berkembang sendiri menulis prosedur yang tidak aman ke dalam memori, prosedur tersebut dapat diambil dan dieksekusi di sesi berikutnya. Setiap konfigurasi yang dikembangkan dan diuji menghasilkan artefak yang tidak aman, dan tiga tugas berbahaya meningkatkan keberhasilan serangan carryover lebih dari dua kali lipat.arxiv.org
  2. InovasiInovasi6 min membaca

    Makalah Mengusulkan "Pelajaran" yang Diambil untuk Meningkatkan Penalaran Spasial dalam Model Bahasa Penglihatan Beku

    Pracetak arXiv menjelaskan Agen Memori Spasial, yang menyimpan pengalaman terverifikasi sebagai pelajaran teks yang diambil pada waktu inferensi, mengklaim perolehan di lima tolok ukur spasial dan empat model bahasa penglihatan tanpa mengubah bobot model. Ini sedang ditinjau; nama abstraknya tidak memiliki tolok ukur, model dasar, atau margin.arxiv.org
  3. InovasiInovasi7 min membaca

    Makalah PROVE-RT Melaporkan 44,7% Keberhasilan Menghasilkan Bukti Real-Time yang Diperiksa Mesin

    Pracetak arXiv menghadirkan PROVE-RT, yang menggunakan pengambilan dan dorongan bertahap untuk membuat model bahasa besar menulis skrip bukti PROSA/ROCQ untuk analisis penjadwalan waktu nyata. Para penulis melaporkan tingkat keberhasilan sebesar 44,7% pada rangkaian evaluasi yang dikurasi, ketika dorongan langsung gagal menghasilkan mekanisasi yang valid dan andal.arxiv.org

Satu pengarahan berguna setiap minggu

Ikuti AI tanpa harus hidup di feed.

Dapatkan berita AI terverifikasi minggu ini, data asli, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.

Send me
One email a week. Switch any time.

Jangkau orang-orang yang sedang mempelajari AI

Menyewa profesional AI atau meluncurkan produk AI yang berguna? Tunjukkan kepada orang-orang yang datang ke sini untuk belajar dan bertindak.

Posting pekerjaan AIKirim alat AI