Dikemas kini setiap hari1982 cerita yang disahkan
Berita AI. Tanpa bunyi bising.
Liputan AI yang diperiksa sumber mengenai pelancaran produk, perubahan dasar, penyelidikan keselamatan, dan langkah industri, dijelaskan dalam bahasa Inggeris mudah oleh pasukan pendidikan bukan untung.
Sumber yang disahkan
Setiap cerita berhubung dengan bukti terkuat yang ada: sumber asal apabila ada, laporan yang sebaliknya jelas dikaitkan.
Bahasa Inggeris biasa
Apa yang berlaku, mengapa ia penting, dan perkara yang perlu ditonton — tanpa jargon.
Tiada pengisi
Apabila isyarat nipis, kami tidak menerbitkan apa-apa selain daripada mengalas suapan.
Lagi cerita
9 ceritaInovasi
Kajian Replikasi Mengatakan FLOP Masih Salah Ramalan Masa Jalan AI, dan Cadangan Pembaikan Gagal pada Perkakasan Baru
Pracetak oleh dua penyelidik menghasilkan semula kajian terdahulu tentang sebab kiraan FLOP yang sama tidak bermakna masa pelaksanaan yang sama. Ia mengesahkan dakwaan asas tetapi melaporkan bahawa formula pembetulan α-FLOPs secara amnya meremehkan masa jalan pada perkakasan yang lebih baharu, yang menunjukkan lompatan dan ayunan yang tidak ditangkap oleh formula.arxiv.orgPerusahaan
Kertas Penanda Aras Menemui Empat Cara untuk Menyoal Data Perusahaan Dengan LLM Semua Skor Di Bawah 26%
Pracetak arXiv baharu menggabungkan empat seni bina untuk pertanyaan bahasa semula jadi bagi pangkalan data perusahaan antara satu sama lain pada penanda aras dwibahasa sintetik. Tiada yang menjawab lebih daripada satu perempat kes dengan betul, dan reka bentuk yang mendapat markah tertinggi bukanlah yang paling selamat atau paling murah.arxiv.orgInovasi
Paper Mencadangkan Penggredan Ejen Keselamatan AI Tanpa Label dengan Mengukur Penumpuan kepada Model yang Lebih Kuat
Pracetak arXiv baharu berhujah bahawa pasukan keselamatan boleh menilai sama ada ejen AI yang dilengkapi memori atau pengambilan sedang belajar dengan mengukur sejauh mana ia merapatkan jurang kepada model "guru" yang lebih kukuh, dan bukannya pada penanda aras berlabel yang selalunya jarang atau basi. Berdasarkan model berkuasa serupa tidak memberikan isyarat yang boleh digunakan.arxiv.orgInovasi
Penanda Aras Baharu Menguji Sama ada Pembantu AI Boleh Mengingat Penggunaan Telefon Setahun
Laporan teknikal 17 pengarang yang disiarkan ke arXiv memperkenalkan MobileMem, penanda aras dan rangka kerja untuk memori jangka panjang pada peranti yang dibina daripada koleksi pengalaman mudah alih berskala tahun. Abstrak menerangkan reka bentuk tetapi tidak melaporkan skor, dan butiran penting tentang data asas kekal tidak didedahkan.arxiv.orgInovasi
Kertas Laporan Organisasi Modular Seperti Otak Muncul Di Dalam Model Bahasa Besar
Pracetak arXiv baharu mengatakan model bahasa besar membangunkan struktur dalaman khusus secara fungsional yang selaras dengan rangkaian otak manusia yang berbeza, berdasarkan analisis litar merentas 46 tugasan dalam empat domain kognitif. Halaman abstrak meninggalkan butiran metodologi utama tidak dinyatakan.arxiv.orgInovasi
Kertas Menemui Lapisan Lewat Model Campuran Pakar Bertolak ansur dengan Masking Pakar Berat
Pracetak melaporkan bahawa melumpuhkan pakar magnitud rendah dalam lima lapisan terakhir model Campuran Pakar 35 bilion parameter mengekalkan output terjemahan kod yang jauh lebih boleh digunakan daripada menyebarkan potongan yang sama pada semua lapisan. Ia meliputi satu model dan satu penanda aras, dan laporan abstrak tiada garis dasar yang didedahkan.arxiv.orgKeselamatan
Kepincangan CoreBreak Biarkan Alat Ejen Berjalan Tanpa Model Dipanggil
Nota penyelidikan Cloud Security Alliance menerangkan CoreBreak, corak kecacatan dalam Amazon Bedrock AgentCore, Kit Pembangunan Ejen Google dan pakej abah-abah AI SDK Vercel yang membenarkan alatan untuk dilaksanakan tanpa pusingan model — meninggalkan pagar tahap model tanpa apa-apa untuk diperiksa.labs.cloudsecurityalliance.orgDasar
Anthropic Butiran Bagaimana Tera Air Teks Claude Akan Berfungsi
Anthropic mengatakan model Claude akan datang akan membenamkan tera air statistik berdasarkan Google SynthID-Text DeepMind, untuk mematuhi Akta AI EU. Syarikat itu mengatakan ia tidak menambah aksara, token atau identiti pengguna - dan penulisan semula penuh mengalahkannya.
anthropic.comindustri
Kursor Mengatakan Pemerolehannya oleh SpaceX Telah Ditutup Secara Rasmi
Kursor menerbitkan catatan pendek mengatakan SpaceX telah menyelesaikan pemerolehan alat pengekodan AI, menyelesaikan proses yang dikatakan bermula pada April dengan perkongsian latihan model dengan SpaceXAI. Siaran itu menjanjikan akses kepada apa yang disebutnya sebagai kumpulan GPU terbesar di dunia, tetapi tidak mendedahkan syarat, garis masa atau perubahan produk.
cursor.com
Satu taklimat berguna setiap minggu
Teruskan AI tanpa perlu hidup dalam suapan itu.
Dapatkan berita AI yang disahkan minggu ini, data asal, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.
Jangkau orang yang belajar AI
Mengupah profesional AI atau melancarkan produk AI yang berguna? Tunjukkan kepada orang yang datang ke sini untuk belajar dan bertindak.
Siarkan kerja AIHantar alat AI