Uppdateras dagligen2127 verifierade berättelser
AI Nyheter. Utan bruset.
Källkontrollerad AI-bevakning av produktlanseringar, policyskiften, säkerhetsforskning och branschrörelser, förklarad på enkel svenska av ett ideellt utbildningsteam.
Verifierad källhänvisning
Varje berättelse länkar till de starkaste tillgängliga bevisen: originalkällor när de finns tillgängliga, annars tydligt tillskrivna rapporteringar.
Vanlig engelska
Vad hände, varför det är viktigt och vad man ska titta på - utan jargong.
Inget fyllmedel
När signalen är tunn publicerar vi ingenting istället för att fylla ut flödet.
Fler berättelser
9 berättelserInnovation
Paper argumenterar för Evolution Strategies Beat RL på att hålla LLM Answer Set Diverse
En ny arXiv preprint hävdar att efterträning av LLM med evolutionsstrategier – en befolkningsbaserad, gradientfri metod som stör vikter direkt – slår förstärkningsinlärning på pass@k och lösningstäckning. Sammanfattningen citerar bättre matematiska benchmarkresultat men nämner inga modeller, benchmarks eller siffror.arxiv.orgSäkerhet
Paper säger att självförbättrande AI-agenter kan förvandla en osäker framgång till en återanvändbar färdighet
En ny arXiv preprint riktmärker ett specifikt agentfelläge: när en självförbättrande agent skriver en osäker procedur i minnet kan den hämtas och köras i senare sessioner. Varje utvecklad konfiguration som testades producerade osäkra artefakter, och tre skadliga uppgifter mer än fördubblade framgången för överförda attacker.arxiv.orgSäkerhet
SEAG Paper föreslår aliasing av känsliga enheter innan RAG-förfrågningar når externa LLM:er
Ett förtryck som postats till arXiv beskriver ett ramverk som byter ut känsliga namn i frågor och hämtade dokument mot alias innan de skickas till en tredjepartsmodell. Författarna rapporterar över 80 % noggrannhet för sin slutanvändarstatistik och frekvenser för fullständig döljande mellan 74,91 % och 77,83 % över tre små modeller.arxiv.orgInnovation
CABS+ Paper rapporterar billigare, snabbare modellsammanslagning i 27 datamängder
Ett förtryck som publicerats på arXiv beskriver CABS+, en modellsammanslagningsmetod som ersätter rutnätssökning med en gradientfri koefficientsökning. Författarna rapporterar tvåsiffriga prestandaökningar över två baslinjer, under en fjärdedel av en baslinjes GPU-minne och ungefär en 4x snabbare än en annan.arxiv.orgInnovation
Paper Proposes Retrieved "Lessons" to Improve Spatial Reasoning in Frozen Vision-Language Models
An arXiv preprint describes Spatial Memory Agent, which stores verified experience as text lessons retrieved at inference time, claiming gains across five spatial benchmarks and four vision-language models without changing model weights. It is under review; its abstract names no benchmarks, base models, or margins.arxiv.orgInnovation
PROVE-RT Paper Reports 44.7% Success Generating Machine-Checked Real-Time Proofs
An arXiv preprint presents PROVE-RT, which uses retrieval and staged prompting to make large language models write PROSA/ROCQ proof scripts for real-time schedulability analysis. The authors report a 44.7% success rate on a curated evaluation set, where direct prompting fails to reliably produce valid mechanizations.arxiv.orgPolitik
Working Paper Asks Whether India's Consumer Law Can Cover AI Harms
A new arXiv working paper argues India's Consumer Protection Act, 2019 is broad enough to reach AI-related harms in principle, but that proving causation and assigning blame across the AI supply chain remain unresolved. Only the abstract is publicly summarized here; the paper is not peer reviewed.arxiv.orgInnovation
Apple Paper Proposes Cheaper Machine Unlearning by Skipping Low-Influence Data
An Apple Machine Learning Research paper argues that not every data point in a deletion request needs active removal. Using influence functions across language and vision tasks, the authors say low-influence examples can be dropped from the forget set, cutting unlearning compute by up to about 50 percent.machinelearning.apple.comInnovation
AutoWorldModel-Bench Tests Whether Coding Agents Can Improve World Models
A new arXiv preprint introduces a benchmark for evaluating coding agents as open-ended world-model researchers across eight game environments, reporting improvements in 63 of 64 sessions.arxiv.org
En användbar genomgång varje vecka
Håll dig uppdaterad med AI utan att leva i flödet.
Få veckans verifierade AI-nyheter, originaldata, användbara verktyg, lärtips och nya AI-jobb.
Nå människor som lär sig AI
Anlita en AI-professionell eller lansera en användbar AI-produkt? Sätt det framför folk som kom hit för att lära sig och agera.
Lägg upp ett AI-jobbSkicka in ett AI-verktyg