Dikemas kini setiap hari1792 cerita yang disahkan

Berita AI.Tanpa bunyi bising.

Liputan AI yang diperiksa sumber mengenai pelancaran produk, perubahan dasar, penyelidikan keselamatan, dan langkah industri, dijelaskan dalam bahasa Inggeris mudah oleh pasukan pendidikan bukan untung.

Sumber yang disahkan

Setiap cerita berhubung dengan bukti terkuat yang ada: sumber asal apabila ada, laporan yang sebaliknya jelas dikaitkan.

Bahasa Inggeris biasa

What happened, why it matters, and what to watch — without the jargon.

Tiada pengisi

Apabila isyarat nipis, kami tidak menerbitkan apa-apa selain daripada mengalas suapan.

Arkib berita

Arkib berita AI — Halaman 148

Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.

Source-provided image accompanying Paper Introduces "Shadow Evaluations": AI Agents Did the Engineering but Failed Two Research QuestionsCerita teratas
Inovasi6 min membaca
Inovasi6 min membaca

Paper Introduces "Shadow Evaluations": AI Agents Did the Engineering but Failed Two Research Questions

A 24-author preprint had frontier AI agents attempt the central research questions of two unpublished NeurIPS 2026 submissions, then had the papers' own authors grade the results. The agents handled the engineering unaided over six days but were unambiguously rejected on the research.

Baca cerita Sumber yang disahkan: arxiv.org
9 cerita
  1. Inovasi7 min membaca

    Kertas Mengatakan Pengurusan Cache Sedar Agen Mengurangkan Kelewatan Token Pertama Sehingga 45% dalam Penyajian Berbilang Ejen

    Pracetak arXiv baharu menerangkan CacheScout, lapisan yang dibina pada pelayan vLLM sumber terbuka yang memutuskan perkara yang perlu disimpan dalam cache nilai kunci model berdasarkan agen mana yang mungkin akan dijalankan seterusnya. Pengarang melaporkan kependaman dua digit dan keuntungan pemprosesan; beban kerja, model dan perkakasan tidak dinyatakan dalam abstrak.

    arxiv.org
  2. Inovasi7 min membaca

    Kajian Replikasi Mengatakan FLOP Masih Salah Ramalan Masa Jalan AI, dan Cadangan Pembaikan Gagal pada Perkakasan Baru

    Pracetak oleh dua penyelidik menghasilkan semula kajian terdahulu tentang sebab kiraan FLOP yang sama tidak bermakna masa pelaksanaan yang sama. Ia mengesahkan dakwaan asas tetapi melaporkan bahawa formula pembetulan α-FLOPs secara amnya meremehkan masa jalan pada perkakasan yang lebih baharu, yang menunjukkan lompatan dan ayunan yang tidak ditangkap oleh formula.

    arxiv.org
  3. Inovasi7 min membaca

    Paper Mencadangkan Penggredan Ejen Keselamatan AI Tanpa Label dengan Mengukur Penumpuan kepada Model yang Lebih Kuat

    Pracetak arXiv baharu berhujah bahawa pasukan keselamatan boleh menilai sama ada ejen AI yang dilengkapi memori atau pengambilan sedang belajar dengan mengukur sejauh mana ia merapatkan jurang kepada model "guru" yang lebih kukuh, dan bukannya pada penanda aras berlabel yang selalunya jarang atau basi. Berdasarkan model berkuasa serupa tidak memberikan isyarat yang boleh digunakan.

    arxiv.org

Satu taklimat berguna setiap minggu

Teruskan AI tanpa perlu hidup dalam suapan itu.

Dapatkan berita AI yang disahkan minggu ini, data asal, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.

Send me
One email a week. Switch any time.

Reach people who are learning AI

Mengupah profesional AI atau melancarkan produk AI yang berguna? Tunjukkan kepada orang yang datang ke sini untuk belajar dan bertindak.

Siarkan kerja AI Hantar alat AI