Dikemas kini setiap hari1821 cerita yang disahkan

Berita AI.Tanpa bunyi bising.

Liputan AI yang diperiksa sumber mengenai pelancaran produk, perubahan dasar, penyelidikan keselamatan, dan langkah industri, dijelaskan dalam bahasa Inggeris mudah oleh pasukan pendidikan bukan untung.

Sumber yang disahkan

Setiap cerita berhubung dengan bukti terkuat yang ada: sumber asal apabila ada, laporan yang sebaliknya jelas dikaitkan.

Bahasa Inggeris biasa

Apa yang berlaku, mengapa ia penting, dan perkara yang perlu ditonton — tanpa jargon.

Tiada pengisi

Apabila isyarat nipis, kami tidak menerbitkan apa-apa selain daripada mengalas suapan.

Arkib berita

Arkib berita AI — Halaman 151

Cerita AI yang disemak sumber, terbaharu dahulu, untuk orang yang perlu memahami AI tanpa mengejar gembar-gembur.

Source-provided image accompanying Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger ModelCerita teratas
Inovasi7 min membaca
Inovasi7 min membaca

Paper Mencadangkan Penggredan Ejen Keselamatan AI Tanpa Label dengan Mengukur Penumpuan kepada Model yang Lebih Kuat

Pracetak arXiv baharu berhujah bahawa pasukan keselamatan boleh menilai sama ada ejen AI yang dilengkapi memori atau pengambilan sedang belajar dengan mengukur sejauh mana ia merapatkan jurang kepada model "guru" yang lebih kukuh, dan bukannya pada penanda aras berlabel yang selalunya jarang atau basi. Berdasarkan model berkuasa serupa tidak memberikan isyarat yang boleh digunakan.

Baca cerita Sumber yang disahkan: arxiv.org
9 cerita
  1. Inovasi7 min membaca

    Kertas Berhujah Strategi Evolusi Mengalahkan RL pada Mengekalkan Set Jawapan LLM Pelbagai

    Pracetak arXiv baharu berpendapat bahawa LLM selepas latihan dengan strategi evolusi — kaedah berasaskan populasi, bebas kecerunan yang mengganggu pemberat secara langsung — mengalahkan pembelajaran pengukuhan pada pass@k dan liputan penyelesaian. Abstrak memetik hasil penanda aras matematik yang lebih baik tetapi tidak menamakan model, penanda aras atau nombor.

    arxiv.org
  2. Keselamatan7 min membaca

    Paper Mengatakan Ejen AI Mempertingkatkan Diri Boleh Mengubah Satu Kejayaan Tidak Selamat Menjadi Kemahiran Boleh Digunakan Semula

    Pracetak arXiv baharu menanda aras mod kegagalan ejen tertentu: apabila ejen yang memperbaiki diri menulis prosedur yang tidak selamat ke dalam ingatan, ia boleh diambil dan dilaksanakan dalam sesi kemudian. Setiap konfigurasi berubah yang diuji menghasilkan artifak yang tidak selamat, dan tiga tugas berniat jahat lebih daripada dua kali ganda kejayaan serangan pemindahan.

    arxiv.org
  3. Keselamatan6 min membaca

    SEAG Paper Mencadang Aliasing Entiti Sensitif Sebelum Pertanyaan RAG Mencapai LLM Luaran

    Pracetak yang disiarkan ke arXiv menerangkan rangka kerja yang menukar nama sensitif dalam pertanyaan dan mendapatkan semula dokumen untuk alias sebelum menghantarnya kepada model pihak ketiga. Penulis melaporkan lebih 80% ketepatan pada metrik pengguna hujung ke hujung mereka, dan kadar penyembunyian penuh antara 74.91% dan 77.83% merentas tiga model kecil.

    arxiv.org

Satu taklimat berguna setiap minggu

Teruskan AI tanpa perlu hidup dalam suapan itu.

Dapatkan berita AI yang disahkan minggu ini, data asal, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.

Send me
One email a week. Switch any time.

Jangkau orang yang belajar AI

Mengupah profesional AI atau melancarkan produk AI yang berguna? Tunjukkan kepada orang yang datang ke sini untuk belajar dan bertindak.

Siarkan kerja AI Hantar alat AI