Oppdateres daglig2000 bekreftede historier
AI Nyheter. Uten støyen.
Kildesjekket AI-dekning av produktlanseringer, endringer i retningslinjene, sikkerhetsundersøkelser og bransjebevegelser, forklart på vanlig engelsk av et nonprofit-utdanningsteam.
Verifisert kilde
Hver historie kobler til de sterkeste tilgjengelige bevisene: originale kilder når de er tilgjengelige, ellers tydelig tilskrevet rapportering.
Vanlig engelsk
Hva skjedde, hvorfor det er viktig og hva du bør se - uten sjargongen.
Ingen filler
Når signalet er tynt, publiserer vi ingenting i stedet for å polstre feeden.
Flere historier
9 historierInnovasjon
Study maps 46 language models built for Portuguese
A systematic mapping study catalogs 46 Portuguese language models and compares architectures, training resources, licensing, code, data, and weights. The authors say the field is growing but difficult to assess because information is spread across papers, technical reports, repositories, and project documentation.arxiv.orgInnovasjon
Interpretability study links Qwen3-4B’s overconfident answers to a certainty-biased mechanism
An arXiv study reports that Qwen3-4B favors certainty over uncertainty in controlled reasoning tasks and identifies model features that may drive the imbalance. The authors say targeted interventions reduced overconfident errors, but the abstract does not disclose effect sizes or testing details.arxiv.orgInnovasjon
The Deontic Gap: Large Language Models and the Modal Language of Obligation
Modal auxiliaries such as must, should, and have to mark necessity and obligation within the contexts of speaker authority and interpersonal stance.arxiv.orgSikkerhet
Paper foreslår å skjule avslagssignaler for å motstå abliterasjonsangrep
Et arXiv forhåndstrykk introduserer en vektredigeringsmetode som skal gjøre sikkerhetsavslag vanskeligere å trekke ut og fjerne. Artikkelen rapporterer sterkere avslagsscore etter alitterasjon på to åpne modeller, med forskjellige avveininger i generell ytelse.arxiv.orgInnovasjon
Paper rapporterer en tidsmessig metode for å oppdage hallusinasjoner på token-nivå
Et arXiv preprint beskriver en hallusinasjonsdetektor som kombinerer tekststatistikk, medfølgende signaler og språkmodelloverraskelse på tvers av sekvenser i stedet for å bedømme tokens uavhengig. BiGRU-modellen nådde en AUC på 0,840 på RAGTruth, ifølge avisen.arxiv.orgInnovasjon
Entity tracking emerges at 410 million parameters, exceeds humans across naturalistic narratives
Understanding language requires tracking entities across discourse - i.e., knowing where things are and how they change, even when not explicitly stated.arxiv.orgInnovasjon
Paper reports compiler-guided search improves Lean theorem-proving efficiency
An arXiv preprint proposes an adaptive proof-search method for context-dependent Lean 4 projects. Its authors report a 12.8-percentage-point average pass-rate improvement within a pass@32 budget while using 21.9% fewer LLM calls than pass@k baselines.arxiv.orgInnovasjon
Benchmark Separates Geometry Solving From Diagram Construction
A new open-source benchmark tests whether foundation models can construct faithful geometry diagrams, not merely solve the underlying problems. Its authors report that evaluated models achieved an average compile success rate of 36.14%, exposing a gap between mathematical answers and usable visual constructions.arxiv.orgInnovasjon
Alignment er alt du trenger: Instruksjonsfri opplæring for generelle lydspråkmodeller
En ny tilnærming til opplæring av multimodale store språkmodeller (MLLM) eliminerer behovet for omfattende oppgavespesifikk veiledning.arxiv.org
En nyttig orientering hver uke
Hold deg oppdatert med AI uten å leve i feeden.
Få ukens bekreftede AI-nyheter, originale data, nyttige verktøy, læringsvalg og ferske AI-jobber.
Nå folk som lærer AI
Ansette en AI-profesjonell eller lansere et nyttig AI-produkt? Sett det foran folk som kom hit for å lære og handle.
Legg ut en AI-jobbSend inn et AI-verktøy