Aggiornato quotidianamente2536 storie verificate
Notizie sull'AI. Senza il rumore.
Copertura controllata dall'IA su lanci di prodotti, cambiamenti di politiche, ricerche sulla sicurezza e mosse del settore, spiegata in un linguaggio semplice da un team educativo non profit.
Fonti verificate
Ogni articolo è collegato alle prove più forti disponibili: fonti originali quando disponibili, altrimenti segnalazioni chiaramente attribuite.
Inglese semplice
Cosa è successo, perché è importante e cosa guardare, senza usare termini tecnici.
Nessun riempitivo
Quando il segnale è debole, non pubblichiamo nulla invece di riempire il feed.
Altre storie
9 storieInnovazione
La nuova prestampa riporta vantaggi derivanti dai modelli linguistici in loop nella chiamata di strumenti in più fasi
Uno studio arXiv valuta i modelli linguistici in loop e convenzionali su tre benchmark di chiamata degli strumenti, riportando risultati più forti sui flussi di lavoro che richiedono più chiamate API dipendenti e un approccio di calcolo adattivo potenzialmente più efficiente.arxiv.orgInnovazione
Adversarial Review tests structured disagreement for agentic code review
A new arXiv paper proposes a three-agent code-review protocol in which a reviewer evaluates an agent’s code and a critic audits that review before edits are made. The authors report improved benchmark results over tested baselines, while also identifying false consensus as a failure mode.arxiv.orgInnovazione
Lo studio ArXiv riporta grandi guadagni nell’incitamento all’odio in romano-urdu grazie all’adattamento di LoRA
Una prestampa arXiv mette a confronto la messa a punto zero-shot e quella efficiente in termini di parametri per il rilevamento dei discorsi di incitamento all'odio nell'urdu romano. Gli autori riferiscono che l'adattamento di LoRA ha aumentato le prestazioni di F1 da 0,56 a oltre 0,93 su un corpus contenente più di 72.000 commenti annotati.arxiv.orgSicurezza
Preliminary FraudBench test finds banking agents vulnerable to adaptive fraud
An arXiv paper introduces FraudBench, a benchmark for testing whether tool-using banking agents can detect fraud that unfolds across conversations. In a preliminary single-trial evaluation, four agents scored 49% to 65% on attack security.arxiv.orgInnovazione
Apple researchers report scaling law for training models with scarce data
A study of more than 2,000 language-model training runs says scarce target data can be repeated 15–20 times in mixtures, with the best rate varying by scale and compute.machinelearning.apple.comInnovazione
Apple Researchers Propose Lexical Substitutions to Improve Multilingual Model Training
Apple researchers describe LINK, a pretraining intervention that replaces selected English words with word-level translations from a target language. The paper reports improvements across eight languages and five model sizes, including up to a twofold speedup in reaching equivalent downstream performance.machinelearning.apple.comPolitica
Position paper calls for certification before AI agents make market decisions
A position paper reports tacit collusion by DeepSeek-R1 agents in a simulated Bertrand pricing market, even after human prompts against collusion. It argues that observed-behavior certification should precede deployment of reasoning agents in economic markets; the evidence and safeguards remain preliminary.arxiv.orgInnovazione
Una revisione sistematica mappa il crescente utilizzo di ampi modelli linguistici nella salute mentale
Una revisione sistematica esamina il modo in cui vengono studiati modelli linguistici di grandi dimensioni per l’analisi della salute mentale, la valutazione del rischio, il supporto terapeutico e il monitoraggio multimodale, sottolineando al contempo le sfide etiche e normative irrisolte.arxiv.orgPolitica
Model Cards Alone May Not Govern Open-Weight Foundation Models, Position Paper Argues
An ICML 2026 position paper analyzing 500 Hugging Face model cards argues that open-weight foundation models need coordinated model cards, acceptable-use policies, and licenses to address safety and governance gaps.arxiv.org
Un briefing utile ogni settimana
Tieni il passo con l'IA senza vivere nel feed.
Ricevi le notizie verificate sull'IA della settimana, dati originali, strumenti utili, scelte per l'apprendimento e nuovi lavori in IA.
Raggiungi le persone che stanno imparando l'intelligenza artificiale
Assumere un professionista dell'IA o lanciare un prodotto AI utile? Mettilo davanti a chi è venuto qui per imparare e agire.
Pubblica un lavoro AIInvia uno strumento AI