Aggiornato quotidianamente2000 storie verificate
Notizie sull'AI. Senza il rumore.
Copertura controllata dall'IA su lanci di prodotti, cambiamenti di politiche, ricerche sulla sicurezza e mosse del settore, spiegata in un linguaggio semplice da un team educativo non profit.
Fonti verificate
Ogni articolo è collegato alle prove più forti disponibili: fonti originali quando disponibili, altrimenti segnalazioni chiaramente attribuite.
Inglese semplice
Cosa è successo, perché è importante e cosa guardare, senza usare termini tecnici.
Nessun riempitivo
Quando il segnale è debole, non pubblichiamo nulla invece di riempire il feed.
Altre storie
9 storieInnovazione
Study maps 46 language models built for Portuguese
A systematic mapping study catalogs 46 Portuguese language models and compares architectures, training resources, licensing, code, data, and weights. The authors say the field is growing but difficult to assess because information is spread across papers, technical reports, repositories, and project documentation.arxiv.orgInnovazione
Interpretability study links Qwen3-4B’s overconfident answers to a certainty-biased mechanism
An arXiv study reports that Qwen3-4B favors certainty over uncertainty in controlled reasoning tasks and identifies model features that may drive the imbalance. The authors say targeted interventions reduced overconfident errors, but the abstract does not disclose effect sizes or testing details.arxiv.orgInnovazione
The Deontic Gap: Large Language Models and the Modal Language of Obligation
Modal auxiliaries such as must, should, and have to mark necessity and obligation within the contexts of speaker authority and interpersonal stance.arxiv.orgSicurezza
Paper proposes obscuring refusal signals to resist abliteration attacks
An arXiv preprint introduces a weight-editing method intended to make safety refusals harder to extract and remove. The paper reports stronger post-abliteration refusal scores on two open models, with different tradeoffs in general-purpose performance.arxiv.orgInnovazione
L'articolo riporta un metodo temporale per rilevare le allucinazioni a livello di token
Una prestampa arXiv descrive un rilevatore di allucinazioni che combina statistiche del testo, segnali di implicazione e sorpresa del modello linguistico attraverso le sequenze invece di giudicare i token in modo indipendente. Secondo il documento, il suo modello BiGRU ha raggiunto un AUC di 0,840 su RAGTruth.arxiv.orgInnovazione
Entity tracking emerges at 410 million parameters, exceeds humans across naturalistic narratives
Understanding language requires tracking entities across discourse - i.e., knowing where things are and how they change, even when not explicitly stated.arxiv.orgInnovazione
Paper reports compiler-guided search improves Lean theorem-proving efficiency
An arXiv preprint proposes an adaptive proof-search method for context-dependent Lean 4 projects. Its authors report a 12.8-percentage-point average pass-rate improvement within a pass@32 budget while using 21.9% fewer LLM calls than pass@k baselines.arxiv.orgInnovazione
Il benchmark separa la risoluzione della geometria dalla costruzione del diagramma
Un nuovo benchmark open source verifica se i modelli di fondazione possono costruire diagrammi geometrici fedeli, non semplicemente risolvere i problemi sottostanti. I suoi autori riferiscono che i modelli valutati hanno raggiunto un tasso medio di successo nella compilazione del 36,14%, evidenziando un divario tra le risposte matematiche e le costruzioni visive utilizzabili.arxiv.orgInnovazione
L'allineamento è tutto ciò di cui hai bisogno: formazione senza istruzioni per modelli generali di linguaggio audio
Un nuovo approccio alla formazione di modelli linguistici multimodali di grandi dimensioni (MLLM) elimina la necessità di un'ampia supervisione specifica per attività.arxiv.org
Un briefing utile ogni settimana
Tieni il passo con l'IA senza vivere nel feed.
Ricevi le notizie verificate sull'IA della settimana, dati originali, strumenti utili, scelte per l'apprendimento e nuovi lavori in IA.
Raggiungi le persone che stanno imparando l'intelligenza artificiale
Assumere un professionista dell'IA o lanciare un prodotto AI utile? Mettilo davanti a chi è venuto qui per imparare e agire.
Pubblica un lavoro AIInvia uno strumento AI