Actualizat zilnic2000 povești verificate
Știri AI. Fără zgomot.
Acoperirea AI verificată la sursă a lansărilor de produse, schimbărilor de politică, cercetării în materie de siguranță și mișcărilor din industrie, explicată în limba engleză simplă de o echipă de educație nonprofit.
Sursă verificată
Fiecare poveste se leagă de cele mai puternice dovezi disponibile: surse originale atunci când sunt disponibile, altfel raportate atribuite în mod clar.
Engleză simplă
Ce s-a întâmplat, de ce contează și ce să urmărești - fără jargon.
Fără umplutură
Când semnalul este subțire, nu publicăm nimic în loc să umplem feedul.
Mai multe povești
9 povestiriInovație
Study maps 46 language models built for Portuguese
A systematic mapping study catalogs 46 Portuguese language models and compares architectures, training resources, licensing, code, data, and weights. The authors say the field is growing but difficult to assess because information is spread across papers, technical reports, repositories, and project documentation.arxiv.orgInovație
Interpretability study links Qwen3-4B’s overconfident answers to a certainty-biased mechanism
An arXiv study reports that Qwen3-4B favors certainty over uncertainty in controlled reasoning tasks and identifies model features that may drive the imbalance. The authors say targeted interventions reduced overconfident errors, but the abstract does not disclose effect sizes or testing details.arxiv.orgInovație
The Deontic Gap: Large Language Models and the Modal Language of Obligation
Modal auxiliaries such as must, should, and have to mark necessity and obligation within the contexts of speaker authority and interpersonal stance.arxiv.orgSecuritate
Paper proposes obscuring refusal signals to resist abliteration attacks
An arXiv preprint introduces a weight-editing method intended to make safety refusals harder to extract and remove. The paper reports stronger post-abliteration refusal scores on two open models, with different tradeoffs in general-purpose performance.arxiv.orgInovație
Lucrarea raportează o metodă temporală pentru detectarea halucinațiilor la nivel de simbol
O pretipărire arXiv descrie un detector de halucinații care combină statistici text, semnale de implicare și model de limbaj surprinzător în secvențe în loc să judece jetoanele în mod independent. Modelul său BiGRU a atins un AUC de 0,840 pe RAGTruth, potrivit lucrării.arxiv.orgInovație
Entity tracking emerges at 410 million parameters, exceeds humans across naturalistic narratives
Understanding language requires tracking entities across discourse - i.e., knowing where things are and how they change, even when not explicitly stated.arxiv.orgInovație
Paper reports compiler-guided search improves Lean theorem-proving efficiency
An arXiv preprint proposes an adaptive proof-search method for context-dependent Lean 4 projects. Its authors report a 12.8-percentage-point average pass-rate improvement within a pass@32 budget while using 21.9% fewer LLM calls than pass@k baselines.arxiv.orgInovație
Benchmark Separates Geometry Solving From Diagram Construction
A new open-source benchmark tests whether foundation models can construct faithful geometry diagrams, not merely solve the underlying problems. Its authors report that evaluated models achieved an average compile success rate of 36.14%, exposing a gap between mathematical answers and usable visual constructions.arxiv.orgInovație
Alignment Is All You Need: Instruction-Free Training for General Audio-Language Models
A new approach to training multimodal large language models (MLLMs) eliminates the need for extensive task-specific supervision.arxiv.org
Un briefing util în fiecare săptămână
Ține pasul cu AI fără a trăi în feed.
Obțineți știrile verificate de AI din săptămână, date originale, instrumente utile, alegeri de învățare și noi locuri de muncă AI.
Ajungeți la oamenii care învață AI
Angajați un profesionist AI sau lansați un produs AI util? Pune-o în fața oamenilor care au venit aici să învețe și să acționeze.
Postați un job AITrimiteți un instrument AI