Diperbarui setiap hari1982 cerita terverifikasi
Berita AI. Tanpa kebisingan.
Liputan AI yang diperiksa sumber tentang peluncuran produk, perubahan kebijakan, riset keselamatan, dan langkah industri, dijelaskan dengan bahasa sederhana oleh tim edukasi nirlaba.
Sumber terverifikasi
Setiap cerita terhubung ke bukti terkuat yang tersedia: sumber asli jika tersedia, dan laporan yang jelas dikaitkan dengan jelas.
Bahasa Inggris Biasa
Apa yang terjadi, mengapa hal itu penting, dan apa yang harus diperhatikan — tanpa jargon.
Tidak ada pengisi
Ketika sinyalnya tipis, kami tidak mempublikasikan apa pun selain mengisi feed.
Lebih banyak cerita
9 ceritaInovasi
Studi Replikasi Mengatakan FLOP Masih Salah Memprediksi Waktu Proses AI, dan Usulan Perbaikan Gagal pada Perangkat Keras Baru
Sebuah pracetak oleh dua peneliti mereproduksi studi sebelumnya tentang mengapa jumlah FLOP yang sama tidak berarti waktu eksekusi yang sama. Hal ini mengkonfirmasi klaim yang mendasarinya tetapi melaporkan bahwa rumus koreksi α-FLOPs umumnya meremehkan waktu proses pada perangkat keras yang lebih baru, yang menunjukkan lompatan dan osilasi yang tidak ditangkap oleh rumus tersebut.arxiv.orgPerusahaan
Makalah Tolok Ukur Menemukan Empat Cara untuk Mengkueri Data Perusahaan Dengan Semua Skor LLM Di Bawah 26%
Pracetak arXiv baru menempatkan empat arsitektur untuk kueri database perusahaan dalam bahasa alami terhadap satu sama lain pada tolok ukur bilingual sintetis. Tidak ada yang menjawab lebih dari seperempat kasus dengan benar, dan desain yang mendapat skor tertinggi bukanlah yang paling aman atau termurah.arxiv.orgInovasi
Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Model
A new arXiv preprint argues security teams can judge whether a memory- or retrieval-equipped AI agent is learning by measuring how far it closes the gap to a stronger "teacher" model, rather than on labeled benchmarks that are often scarce or stale. Judging by a similarly powered model gave no usable signal.arxiv.orgInovasi
New Benchmark Tests Whether AI Assistants Can Remember a Year of Phone Use
A 17-author technical report posted to arXiv introduces MobileMem, a benchmark and framework for on-device long-term memory built from a year-scale collection of mobile experiences. The abstract describes the design but reports no scores, and key details about the underlying data remain undisclosed.arxiv.orgInovasi
Paper Reports Brain-Like Modular Organization Emerging Inside Large Language Models
A new arXiv preprint says large language models develop functionally specialized internal structure that lines up with distinct human brain networks, based on circuit analyses across 46 tasks in four cognitive domains. The abstract page leaves key methodological details unstated.arxiv.orgInovasi
Paper Finds Late Layers of a Mixture-of-Experts Model Tolerate Heavy Expert Masking
A preprint reports that disabling low-magnitude experts in the last five layers of a 35-billion-parameter Mixture-of-Experts model preserved far more usable code-translation outputs than spreading the same cuts across all layers. It covers one model and one benchmark, and the abstract reports no unmasked baseline.arxiv.orgKeamanan
Cacat CoreBreak Membiarkan Alat Agen Berjalan Tanpa Model Dipanggil
Catatan penelitian Cloud Security Alliance menjelaskan CoreBreak, sebuah pola kelemahan pada Amazon Bedrock AgentCore, Agent Development Kit Google, dan paket harness AI SDK Vercel yang memungkinkan alat untuk dijalankan tanpa pergantian model — sehingga pagar pembatas tingkat model tidak perlu diperiksa.labs.cloudsecurityalliance.orgKebijakan
Anthropic Merinci Cara Kerja Tanda Air Teks Claude
Anthropic mengatakan model Claude masa depan akan menyematkan tanda air statistik berdasarkan Google SynthID-Text DeepMind, untuk mematuhi EU AI Act. Perusahaan mengatakan tidak menambahkan karakter, token, atau identitas pengguna – dan penulisan ulang penuh akan mengalahkannya.
anthropic.comIndustri
Cursor Mengatakan Akuisisinya oleh SpaceX Telah Resmi Ditutup
Cursor menerbitkan postingan singkat yang mengatakan SpaceX telah menyelesaikan akuisisi alat pengkodean AI, menyelesaikan proses yang dikatakan dimulai pada bulan April dengan kemitraan pelatihan model dengan SpaceXAI. Postingan tersebut menjanjikan akses ke apa yang disebutnya sebagai armada GPU terbesar di dunia, namun tidak mengungkapkan syarat, jadwal, atau perubahan produk.
cursor.com
Satu pengarahan berguna setiap minggu
Ikuti AI tanpa harus hidup di feed.
Dapatkan berita AI terverifikasi minggu ini, data asli, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.
Jangkau orang-orang yang sedang mempelajari AI
Menyewa profesional AI atau meluncurkan produk AI yang berguna? Tunjukkan kepada orang-orang yang datang ke sini untuk belajar dan bertindak.
Posting pekerjaan AIKirim alat AI