Dikemas kini setiap hari1794 cerita yang disahkan

Berita AI.Tanpa bunyi bising.

Liputan AI yang diperiksa sumber mengenai pelancaran produk, perubahan dasar, penyelidikan keselamatan, dan langkah industri, dijelaskan dalam bahasa Inggeris mudah oleh pasukan pendidikan bukan untung.

Sumber yang disahkan

Setiap cerita berhubung dengan bukti terkuat yang ada: sumber asal apabila ada, laporan yang sebaliknya jelas dikaitkan.

Bahasa Inggeris biasa

What happened, why it matters, and what to watch — without the jargon.

Tiada pengisi

Apabila isyarat nipis, kami tidak menerbitkan apa-apa selain daripada mengalas suapan.

Arkib berita

Arkib berita AI — Halaman 149

Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.

Source-page capture accompanying Paper Finds Late Layers of a Mixture-of-Experts Model Tolerate Heavy Expert MaskingCerita teratas
Inovasi7 min membaca
Inovasi7 min membaca

Kertas Menemui Lapisan Lewat Model Campuran Pakar Bertolak ansur dengan Masking Pakar Berat

Pracetak melaporkan bahawa melumpuhkan pakar magnitud rendah dalam lima lapisan terakhir model Campuran Pakar 35 bilion parameter mengekalkan output terjemahan kod yang jauh lebih boleh digunakan daripada menyebarkan potongan yang sama pada semua lapisan. Ia meliputi satu model dan satu penanda aras, dan laporan abstrak tiada garis dasar yang didedahkan.

Baca cerita Sumber yang disahkan: arxiv.org
9 cerita
  1. Inovasi7 min membaca

    Kertas Berhujah Strategi Evolusi Mengalahkan RL pada Mengekalkan Set Jawapan LLM Pelbagai

    Pracetak arXiv baharu berpendapat bahawa LLM selepas latihan dengan strategi evolusi — kaedah berasaskan populasi, bebas kecerunan yang mengganggu pemberat secara langsung — mengalahkan pembelajaran pengukuhan pada pass@k dan liputan penyelesaian. Abstrak memetik hasil penanda aras matematik yang lebih baik tetapi tidak menamakan model, penanda aras atau nombor.

    arxiv.org
  2. Keselamatan7 min membaca

    Paper Mengatakan Ejen AI Mempertingkatkan Diri Boleh Mengubah Satu Kejayaan Tidak Selamat Menjadi Kemahiran Boleh Digunakan Semula

    Pracetak arXiv baharu menanda aras mod kegagalan ejen tertentu: apabila ejen yang memperbaiki diri menulis prosedur yang tidak selamat ke dalam ingatan, ia boleh diambil dan dilaksanakan dalam sesi kemudian. Setiap konfigurasi berubah yang diuji menghasilkan artifak yang tidak selamat, dan tiga tugas berniat jahat lebih daripada dua kali ganda kejayaan serangan pemindahan.

    arxiv.org
  3. Keselamatan6 min membaca

    SEAG Paper Mencadang Aliasing Entiti Sensitif Sebelum Pertanyaan RAG Mencapai LLM Luaran

    Pracetak yang disiarkan ke arXiv menerangkan rangka kerja yang menukar nama sensitif dalam pertanyaan dan mendapatkan semula dokumen untuk alias sebelum menghantarnya kepada model pihak ketiga. Penulis melaporkan lebih 80% ketepatan pada metrik pengguna hujung ke hujung mereka, dan kadar penyembunyian penuh antara 74.91% dan 77.83% merentas tiga model kecil.

    arxiv.org
  4. Inovasi6 min membaca

    Kertas Mencadangkan "Pelajaran" yang Diperoleh untuk Memperbaik Penaakulan Ruang dalam Model Bahasa Penglihatan Beku

    Pracetak arXiv menerangkan Ejen Memori Spatial, yang menyimpan pengalaman yang disahkan sebagai pelajaran teks yang diperoleh pada masa inferens, menuntut keuntungan merentas lima penanda aras spatial dan empat model bahasa penglihatan tanpa mengubah berat model. Ia dalam semakan; nama abstraknya tiada tanda aras, model asas atau jidar.

    arxiv.org

Satu taklimat berguna setiap minggu

Teruskan AI tanpa perlu hidup dalam suapan itu.

Dapatkan berita AI yang disahkan minggu ini, data asal, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.

Send me
One email a week. Switch any time.

Reach people who are learning AI

Mengupah profesional AI atau melancarkan produk AI yang berguna? Tunjukkan kepada orang yang datang ke sini untuk belajar dan bertindak.

Siarkan kerja AI Hantar alat AI