Aggiornato quotidianamente2286 storie verificate
Notizie sull'AI. Senza il rumore.
Copertura controllata dall'IA su lanci di prodotti, cambiamenti di politiche, ricerche sulla sicurezza e mosse del settore, spiegata in un linguaggio semplice da un team educativo non profit.
Fonti verificate
Ogni articolo è collegato alle prove più forti disponibili: fonti originali quando disponibili, altrimenti segnalazioni chiaramente attribuite.
Inglese semplice
Cosa è successo, perché è importante e cosa guardare, senza usare termini tecnici.
Nessun riempitivo
Quando il segnale è debole, non pubblichiamo nulla invece di riempire il feed.
Altre storie
9 storieInnovazione
Code agents lose reliability when code is rewritten without changing its meaning, study finds
An arXiv preprint reports that code agents can perform differently on semantically equivalent codebases, with effects varying by model, agent framework and benchmark.arxiv.orgInnovazione
Enhanced Fuzzy Logic Model for Power Transformer Fault Diagnosis Using IEEE Key Gas Method Improvements
This study presents an enhanced model combining Fuzzy Logic with the IEEE Key Gas Method (FL-KGM) that introduces refined membership functions, optimized fuzzy rule sets, and a novel separation of CO and CO2 to eliminate diagnostic inconsistencies.arxiv.orgInnovazione
La nuova prestampa riporta vantaggi derivanti dai modelli linguistici in loop nella chiamata di strumenti in più fasi
Uno studio arXiv valuta i modelli linguistici in loop e convenzionali su tre benchmark di chiamata degli strumenti, riportando risultati più forti sui flussi di lavoro che richiedono più chiamate API dipendenti e un approccio di calcolo adattivo potenzialmente più efficiente.arxiv.orgInnovazione
Adversarial Review tests structured disagreement for agentic code review
A new arXiv paper proposes a three-agent code-review protocol in which a reviewer evaluates an agent’s code and a critic audits that review before edits are made. The authors report improved benchmark results over tested baselines, while also identifying false consensus as a failure mode.arxiv.orgInnovazione
Lo studio ArXiv riporta grandi guadagni nell’incitamento all’odio in romano-urdu grazie all’adattamento di LoRA
Una prestampa arXiv mette a confronto la messa a punto zero-shot e quella efficiente in termini di parametri per il rilevamento dei discorsi di incitamento all'odio nell'urdu romano. Gli autori riferiscono che l'adattamento di LoRA ha aumentato le prestazioni di F1 da 0,56 a oltre 0,93 su un corpus contenente più di 72.000 commenti annotati.arxiv.orgSicurezza
Preliminary FraudBench test finds banking agents vulnerable to adaptive fraud
An arXiv paper introduces FraudBench, a benchmark for testing whether tool-using banking agents can detect fraud that unfolds across conversations. In a preliminary single-trial evaluation, four agents scored 49% to 65% on attack security.arxiv.orgInnovazione
Apple researchers report scaling law for training models with scarce data
A study of more than 2,000 language-model training runs says scarce target data can be repeated 15–20 times in mixtures, with the best rate varying by scale and compute.machinelearning.apple.comInnovazione
Apple Researchers Propose Lexical Substitutions to Improve Multilingual Model Training
Apple researchers describe LINK, a pretraining intervention that replaces selected English words with word-level translations from a target language. The paper reports improvements across eight languages and five model sizes, including up to a twofold speedup in reaching equivalent downstream performance.machinelearning.apple.comPolitica
Position paper calls for certification before AI agents make market decisions
A position paper reports tacit collusion by DeepSeek-R1 agents in a simulated Bertrand pricing market, even after human prompts against collusion. It argues that observed-behavior certification should precede deployment of reasoning agents in economic markets; the evidence and safeguards remain preliminary.arxiv.org
Un briefing utile ogni settimana
Tieni il passo con l'IA senza vivere nel feed.
Ricevi le notizie verificate sull'IA della settimana, dati originali, strumenti utili, scelte per l'apprendimento e nuovi lavori in IA.
Raggiungi le persone che stanno imparando l'intelligenza artificiale
Assumere un professionista dell'IA o lanciare un prodotto AI utile? Mettilo davanti a chi è venuto qui per imparare e agire.
Pubblica un lavoro AIInvia uno strumento AI