Uppdateras dagligen2000 verifierade berättelser
AI Nyheter. Utan bruset.
Källkontrollerad AI-bevakning av produktlanseringar, policyskiften, säkerhetsforskning och branschrörelser, förklarad på enkel svenska av ett ideellt utbildningsteam.
Verifierad källhänvisning
Varje berättelse länkar till de starkaste tillgängliga bevisen: originalkällor när de finns tillgängliga, annars tydligt tillskrivna rapporteringar.
Vanlig engelska
Vad hände, varför det är viktigt och vad man ska titta på - utan jargong.
Inget fyllmedel
När signalen är tunn publicerar vi ingenting istället för att fylla ut flödet.
Fler berättelser
9 berättelserInnovation
Study maps 46 language models built for Portuguese
A systematic mapping study catalogs 46 Portuguese language models and compares architectures, training resources, licensing, code, data, and weights. The authors say the field is growing but difficult to assess because information is spread across papers, technical reports, repositories, and project documentation.arxiv.orgInnovation
Interpretability study links Qwen3-4B’s overconfident answers to a certainty-biased mechanism
An arXiv study reports that Qwen3-4B favors certainty over uncertainty in controlled reasoning tasks and identifies model features that may drive the imbalance. The authors say targeted interventions reduced overconfident errors, but the abstract does not disclose effect sizes or testing details.arxiv.orgInnovation
The Deontic Gap: Large Language Models and the Modal Language of Obligation
Modal auxiliaries such as must, should, and have to mark necessity and obligation within the contexts of speaker authority and interpersonal stance.arxiv.orgSäkerhet
Paper proposes obscuring refusal signals to resist abliteration attacks
An arXiv preprint introduces a weight-editing method intended to make safety refusals harder to extract and remove. The paper reports stronger post-abliteration refusal scores on two open models, with different tradeoffs in general-purpose performance.arxiv.orgInnovation
Paper reports a temporal method for detecting hallucinations at the token level
An arXiv preprint describes a hallucination detector that combines text statistics, entailment signals and language-model surprisal across sequences instead of judging tokens independently. Its BiGRU model reached an AUC of 0.840 on RAGTruth, according to the paper.arxiv.orgInnovation
Entity tracking emerges at 410 million parameters, exceeds humans across naturalistic narratives
Understanding language requires tracking entities across discourse - i.e., knowing where things are and how they change, even when not explicitly stated.arxiv.orgInnovation
Pappersrapporter, kompilatorvägd sökning förbättrar Lean-satsens effektivitet
En arXiv preprint föreslår en adaptiv korrektursökningsmetod för kontextberoende Lean 4-projekt. Dess författare rapporterar en 12,8-procentenheters genomsnittlig genomgångsförbättring inom en pass@32-budget samtidigt som de använder 21,9 % färre LLM-samtal än pass@k-baslinjer.arxiv.orgInnovation
Benchmark skiljer geometrilösning från diagramkonstruktion
Ett nytt benchmark med öppen källkod testar om grundmodeller kan konstruera trogna geometridiagram, inte bara lösa de underliggande problemen. Dess författare rapporterar att utvärderade modeller uppnådde en genomsnittlig framgångsfrekvens för kompilering på 36,14 %, vilket avslöjar ett gap mellan matematiska svar och användbara visuella konstruktioner.arxiv.orgInnovation
Alignment Is All You Need: Instruction-Free Training for General Audio-Language Models
A new approach to training multimodal large language models (MLLMs) eliminates the need for extensive task-specific supervision.arxiv.org
En användbar genomgång varje vecka
Håll dig uppdaterad med AI utan att leva i flödet.
Få veckans verifierade AI-nyheter, originaldata, användbara verktyg, lärtips och nya AI-jobb.
Nå människor som lär sig AI
Anlita en AI-professionell eller lansera en användbar AI-produkt? Sätt det framför folk som kom hit för att lära sig och agera.
Lägg upp ett AI-jobbSkicka in ett AI-verktyg