Diperbarui setiap hari1421 cerita terverifikasi

Berita AI.Tanpa kebisingan.

Source-checked AI coverage of product launches, policy shifts, safety research, and industry moves, explained in plain English by a nonprofit education team.

Verified sourcing

Every story links to the strongest available evidence: original sources when available, otherwise clearly attributed reporting.

Bahasa Inggris Biasa

Apa yang terjadi, mengapa hal itu penting, dan apa yang harus diperhatikan — tanpa jargon pajak.

Tidak ada pengisi

Ketika sinyalnya tipis, kami tidak mempublikasikan apa pun selain mengisi feed.

Arsip berita

Arsip berita AI — Halaman 118

Semakin banyak perspektif terverifikasi bagi orang-orang yang perlu memahami AI tanpa mengejar sensasi.

9 cerita
  1. Keamanan7 min membaca

    Paper Mengatakan Agen AI yang Berkembang Sendiri Dapat Mengubah Kesuksesan yang Tidak Aman Menjadi Keterampilan yang Dapat Digunakan Kembali

    Pracetak arXiv baru menandai mode kegagalan agen tertentu: ketika agen yang berkembang sendiri menulis prosedur yang tidak aman ke dalam memori, prosedur tersebut dapat diambil dan dieksekusi di sesi berikutnya. Setiap konfigurasi yang dikembangkan dan diuji menghasilkan artefak yang tidak aman, dan tiga tugas berbahaya meningkatkan keberhasilan serangan carryover lebih dari dua kali lipat.

    arxiv.org
  2. Inovasi6 min membaca

    Makalah Mengusulkan "Pelajaran" yang Diambil untuk Meningkatkan Penalaran Spasial dalam Model Bahasa Penglihatan Beku

    Pracetak arXiv menjelaskan Agen Memori Spasial, yang menyimpan pengalaman terverifikasi sebagai pelajaran teks yang diambil pada waktu inferensi, mengklaim perolehan di lima tolok ukur spasial dan empat model bahasa penglihatan tanpa mengubah bobot model. Ini sedang ditinjau; nama abstraknya tidak memiliki tolok ukur, model dasar, atau margin.

    arxiv.org
  3. Inovasi7 min membaca

    Makalah PROVE-RT Melaporkan 44,7% Keberhasilan Menghasilkan Bukti Real-Time yang Diperiksa Mesin

    Pracetak arXiv menghadirkan PROVE-RT, yang menggunakan pengambilan dan dorongan bertahap untuk membuat model bahasa besar menulis skrip bukti PROSA/ROCQ untuk analisis penjadwalan waktu nyata. Para penulis melaporkan tingkat keberhasilan sebesar 44,7% pada rangkaian evaluasi yang dikurasi, ketika dorongan langsung gagal menghasilkan mekanisasi yang valid dan andal.

    arxiv.org
  4. Kebijakan6 min membaca

    Makalah Kerja Menanyakan Apakah Undang-Undang Konsumen India Dapat Mencakup Bahaya AI

    Makalah kerja arXiv yang baru berpendapat bahwa Undang-Undang Perlindungan Konsumen India tahun 2019 pada prinsipnya cukup luas untuk mencakup dampak buruk terkait AI, namun hal ini membuktikan bahwa penyebab dan menyalahkan rantai pasokan AI masih belum terselesaikan. Hanya abstrak yang dirangkum secara publik di sini; makalah ini tidak ditinjau oleh rekan sejawat.

    arxiv.org

One useful briefing each week

Keep up with AI without living in the feed.

Get the week’s verified AI news, original data, useful tools, learning picks, and fresh AI jobs.

Send me
One email a week. Switch any time.

Build with our audience

Hiring an AI professional or launching a useful AI product? Put it in front of people who came here to learn and act.

Posting pekerjaan AI Submit an AI tool