Dagelijks bijgewerkt1873 Geverifieerde verhalen
AI-nieuws. Zonder het lawaai.
Brongecontroleerde AI-verslaggeving van productlanceringen, beleidswijzigingen, veiligheidsonderzoek en industriële bewegingen, uitgelegd in eenvoudig Nederlands door een non-profit educatieteam.
Geverifieerde bronnen
Elk verhaal verwijst naar het sterkst beschikbare bewijs: originele bronnen indien beschikbaar, anders duidelijk toegeschreven verslaggeving.
Gewoon Engels
Wat er is gebeurd, waarom het ertoe doet en waar je naar moet kijken – zonder het jargon.
Geen opvulling
Wanneer het signaal dun is, publiceren we niets in plaats van de feed op te vullen.
Meer verhalen
9 VerhalenBeveiliging
SEAG Paper Proposes Aliasing Sensitive Entities Before RAG Queries Reach External LLMs
A preprint posted to arXiv describes a framework that swaps sensitive names in queries and retrieved documents for aliases before sending them to a third-party model. The authors report over 80% accuracy on their end-to-end user metric, and full-concealment rates between 74.91% and 77.83% across three small models.arxiv.orgInnovatie
CABS+ Paper rapporteert goedkopere, snellere samenvoeging van modellen uit 27 datasets
Een preprint op arXiv beschrijft CABS+, een methode voor het samenvoegen van modellen die het zoeken naar rasters vervangt door zoeken naar gradiëntvrije coëfficiënten. De auteurs rapporteren prestatieverbeteringen met dubbele cijfers over twee basislijnen, minder dan een kwart van het GPU-geheugen van de ene basislijn, en een versnelling van ongeveer 4x ten opzichte van een andere.arxiv.orgInnovatie
Paper stelt opgehaalde ‘lessen’ voor om ruimtelijk redeneren in bevroren visie-taalmodellen te verbeteren
Een arXiv-voordruk beschrijft Spatial Memory Agent, die geverifieerde ervaringen opslaat als tekstlessen die worden opgehaald tijdens de inferentie, en claimt winst over vijf ruimtelijke benchmarks en vier visie-taalmodellen zonder de modelgewichten te veranderen. Het wordt momenteel beoordeeld; de samenvatting ervan noemt geen benchmarks, basismodellen of marges.arxiv.orgInnovatie
PROVE-RT Paper rapporteert 44,7% succes bij het genereren van machinaal gecontroleerde realtime proefdrukken
Een arXiv-voordruk presenteert PROVE-RT, dat gebruikmaakt van ophaal- en gefaseerde aanwijzingen om grote taalmodellen PROSA/ROCQ-proof-scripts te laten schrijven voor realtime analyse van de planning. De auteurs rapporteren een succespercentage van 44,7% op een samengestelde evaluatieset, waarbij directe aanwijzingen er niet in slagen om op betrouwbare wijze geldige mechanisaties te produceren.arxiv.orgBeleid
In een werkdocument wordt de vraag gesteld of de Indiase consumentenwetgeving de schade van AI kan dekken
In een nieuw werkdocument van arXiv wordt betoogd dat de Indiase Consumer Protection Act uit 2019 breed genoeg is om in principe AI-gerelateerde schade te berokkenen, maar dat het bewijzen van het oorzakelijk verband en het toewijzen van schuld aan de hele AI-toeleveringsketen onopgelost blijven. Alleen de samenvatting wordt hier publiekelijk samengevat; het artikel is niet peer-reviewed.arxiv.orgInnovatie
Apple Paper stelt goedkopere machine-ontleren voor door gegevens met lage invloed over te slaan
In een artikel van Apple Machine Learning Research wordt gesteld dat niet elk datapunt in een verwijderingsverzoek actief moet worden verwijderd. Door gebruik te maken van invloedsfuncties voor taal- en visietaken, zeggen de auteurs dat voorbeelden met een lage invloed uit de vergeetset kunnen worden geschrapt, waardoor het afleren van computergebruik tot ongeveer 50 procent kan worden verminderd.machinelearning.apple.comInnovatie
AutoWorldModel-Bench test of codeeragenten wereldmodellen kunnen verbeteren
Een nieuwe arXiv-voordruk introduceert een benchmark voor het evalueren van codeeragenten als open-end wereldmodelonderzoekers in acht game-omgevingen, waarbij verbeteringen worden gerapporteerd in 63 van de 64 sessies.arxiv.orgInnovatie
Distribird Paper beschrijft op literatuur gebaseerde AI-agenten voor Bayesiaanse modelprioristen
Een arXiv-voordruk presenteert Distribird, een multi-agentapplicatie die wetenschappelijke literatuur doorzoekt, gerapporteerde parameterwaarden extraheert en traceerbare eerdere distributies construeert voor Bayesiaanse modelkalibratie.arxiv.orgInnovatie
Onderzoekers introduceren OmniLens voor de interpreteerbaarheid van taalmodellen op grote schaal
Een nieuw arXiv-paper beschrijft OmniLens, een goedkopere methode voor het onderzoeken van interne signalen in hele grote taalmodellen en het identificeren van waar gedrag verschijnt versus waar interventies werken.arxiv.org
Elke week één nuttige briefing
Houd AI bij zonder in de feed te leven.
Ontvang het geverifieerde AI-nieuws van de week, originele data, nuttige tools, leertips en nieuwe AI-banen.
Bereik mensen die AI leren
Een AI-professional inhuren of een nuttig AI-product lanceren? Zet het voor mensen die hier zijn gekomen om te leren en te acteren.
Plaats een AI-taakDien een AI-tool in