Dagelijks bijgewerkt2286 Geverifieerde verhalen
AI-nieuws. Zonder het lawaai.
Brongecontroleerde AI-verslaggeving van productlanceringen, beleidswijzigingen, veiligheidsonderzoek en industriële bewegingen, uitgelegd in eenvoudig Nederlands door een non-profit educatieteam.
Geverifieerde bronnen
Elk verhaal verwijst naar het sterkst beschikbare bewijs: originele bronnen indien beschikbaar, anders duidelijk toegeschreven verslaggeving.
Gewoon Engels
Wat er is gebeurd, waarom het ertoe doet en waar je naar moet kijken – zonder het jargon.
Geen opvulling
Wanneer het signaal dun is, publiceren we niets in plaats van de feed op te vullen.
Meer verhalen
9 VerhalenInnovatie
Code agents lose reliability when code is rewritten without changing its meaning, study finds
An arXiv preprint reports that code agents can perform differently on semantically equivalent codebases, with effects varying by model, agent framework and benchmark.arxiv.orgInnovatie
Enhanced Fuzzy Logic Model for Power Transformer Fault Diagnosis Using IEEE Key Gas Method Improvements
This study presents an enhanced model combining Fuzzy Logic with the IEEE Key Gas Method (FL-KGM) that introduces refined membership functions, optimized fuzzy rule sets, and a novel separation of CO and CO2 to eliminate diagnostic inconsistencies.arxiv.orgInnovatie
Nieuwe preprint-rapporten profiteren van doorgeluste taalmodellen bij het aanroepen van tools in meerdere stappen
Een arXiv-studie evalueert looped en conventionele taalmodellen op basis van drie tool-calling benchmarks, en rapporteert sterkere resultaten op workflows die meerdere afhankelijke API-aanroepen vereisen en een potentieel efficiëntere adaptieve berekeningsaanpak.arxiv.orgInnovatie
Adversarial Review tests structured disagreement for agentic code review
A new arXiv paper proposes a three-agent code-review protocol in which a reviewer evaluates an agent’s code and a critic audits that review before edits are made. The authors report improved benchmark results over tested baselines, while also identifying false consensus as a failure mode.arxiv.orgInnovatie
Het ArXiv-onderzoek rapporteert grote winsten in het Romeinse Urdu voor haatzaaiende uitspraken als gevolg van LoRA-aanpassing
Een arXiv-voordruk vergelijkt zero-shot en parameter-efficiënte fijnafstemming voor detectie van haatzaaiende uitspraken in Romeins Urdu. De auteurs melden dat LoRA-aanpassing de F1-prestaties verhoogde van 0,56 naar boven 0,93 op een corpus met meer dan 72.000 geannoteerde commentaren.arxiv.orgBeveiliging
Preliminary FraudBench test finds banking agents vulnerable to adaptive fraud
An arXiv paper introduces FraudBench, a benchmark for testing whether tool-using banking agents can detect fraud that unfolds across conversations. In a preliminary single-trial evaluation, four agents scored 49% to 65% on attack security.arxiv.orgInnovatie
Apple researchers report scaling law for training models with scarce data
A study of more than 2,000 language-model training runs says scarce target data can be repeated 15–20 times in mixtures, with the best rate varying by scale and compute.machinelearning.apple.comInnovatie
Apple Researchers Propose Lexical Substitutions to Improve Multilingual Model Training
Apple researchers describe LINK, a pretraining intervention that replaces selected English words with word-level translations from a target language. The paper reports improvements across eight languages and five model sizes, including up to a twofold speedup in reaching equivalent downstream performance.machinelearning.apple.comBeleid
Position paper calls for certification before AI agents make market decisions
A position paper reports tacit collusion by DeepSeek-R1 agents in a simulated Bertrand pricing market, even after human prompts against collusion. It argues that observed-behavior certification should precede deployment of reasoning agents in economic markets; the evidence and safeguards remain preliminary.arxiv.org
Elke week één nuttige briefing
Houd AI bij zonder in de feed te leven.
Ontvang het geverifieerde AI-nieuws van de week, originele data, nuttige tools, leertips en nieuwe AI-banen.
Bereik mensen die AI leren
Een AI-professional inhuren of een nuttig AI-product lanceren? Zet het voor mensen die hier zijn gekomen om te leren en te acteren.
Plaats een AI-taakDien een AI-tool in