Dikemas kini setiap hari2286 cerita yang disahkan
Berita AI. Tanpa bunyi bising.
Liputan AI yang diperiksa sumber mengenai pelancaran produk, perubahan dasar, penyelidikan keselamatan, dan langkah industri, dijelaskan dalam bahasa Inggeris mudah oleh pasukan pendidikan bukan untung.
Sumber yang disahkan
Setiap cerita berhubung dengan bukti terkuat yang ada: sumber asal apabila ada, laporan yang sebaliknya jelas dikaitkan.
Bahasa Inggeris biasa
Apa yang berlaku, mengapa ia penting, dan perkara yang perlu ditonton — tanpa jargon.
Tiada pengisi
Apabila isyarat nipis, kami tidak menerbitkan apa-apa selain daripada mengalas suapan.
Lagi cerita
9 ceritaInovasi
Code agents lose reliability when code is rewritten without changing its meaning, study finds
An arXiv preprint reports that code agents can perform differently on semantically equivalent codebases, with effects varying by model, agent framework and benchmark.arxiv.orgInovasi
Model Logik Fuzzy Dipertingkatkan untuk Diagnosis Kerosakan Transformer Kuasa Menggunakan Penambahbaikan Kaedah Gas Utama IEEE
Kajian ini mempersembahkan model yang dipertingkatkan yang menggabungkan Logik Kabur dengan Kaedah Gas Utama IEEE (FL-KGM) yang memperkenalkan fungsi keahlian yang diperhalusi, set peraturan kabur yang dioptimumkan dan pemisahan baru CO dan CO2 untuk menghapuskan ketidakkonsistenan diagnostik.arxiv.orgInovasi
New preprint reports gains from looped language models in multi-step tool calling
An arXiv study evaluates looped and conventional language models on three tool-calling benchmarks, reporting stronger results on workflows that require multiple dependent API calls and a potentially more efficient adaptive-computation approach.arxiv.orgInovasi
Adversarial Review tests structured disagreement for agentic code review
A new arXiv paper proposes a three-agent code-review protocol in which a reviewer evaluates an agent’s code and a critic audits that review before edits are made. The authors report improved benchmark results over tested baselines, while also identifying false consensus as a failure mode.arxiv.orgInovasi
ArXiv study reports large Roman Urdu hate-speech gains from LoRA adaptation
An arXiv preprint compares zero-shot and parameter-efficient fine-tuning for hate-speech detection in Roman Urdu. The authors report that LoRA adaptation raised F1 performance from 0.56 to above 0.93 on a corpus containing more than 72,000 annotated comments.arxiv.orgKeselamatan
Preliminary FraudBench test finds banking agents vulnerable to adaptive fraud
An arXiv paper introduces FraudBench, a benchmark for testing whether tool-using banking agents can detect fraud that unfolds across conversations. In a preliminary single-trial evaluation, four agents scored 49% to 65% on attack security.arxiv.orgInovasi
Penyelidik Apple melaporkan undang-undang penskalaan untuk model latihan dengan data yang terhad
Kajian terhadap lebih daripada 2,000 larian latihan model bahasa mengatakan data sasaran yang terhad boleh diulang 15–20 kali dalam campuran, dengan kadar terbaik berbeza mengikut skala dan pengiraan.machinelearning.apple.comInovasi
Apple Researchers Propose Lexical Substitutions to Improve Multilingual Model Training
Apple researchers describe LINK, a pretraining intervention that replaces selected English words with word-level translations from a target language. The paper reports improvements across eight languages and five model sizes, including up to a twofold speedup in reaching equivalent downstream performance.machinelearning.apple.comDasar
Position paper calls for certification before AI agents make market decisions
A position paper reports tacit collusion by DeepSeek-R1 agents in a simulated Bertrand pricing market, even after human prompts against collusion. It argues that observed-behavior certification should precede deployment of reasoning agents in economic markets; the evidence and safeguards remain preliminary.arxiv.org
Satu taklimat berguna setiap minggu
Teruskan AI tanpa perlu hidup dalam suapan itu.
Dapatkan berita AI yang disahkan minggu ini, data asal, alat berguna, pilihan pembelajaran, dan pekerjaan AI segar.
Jangkau orang yang belajar AI
Mengupah profesional AI atau melancarkan produk AI yang berguna? Tunjukkan kepada orang yang datang ke sini untuk belajar dan bertindak.
Siarkan kerja AIHantar alat AI