Actualizat zilnic1873 povești verificate
Știri AI. Fără zgomot.
Acoperirea AI verificată la sursă a lansărilor de produse, schimbărilor de politică, cercetării în materie de siguranță și mișcărilor din industrie, explicată în limba engleză simplă de o echipă de educație nonprofit.
Sursă verificată
Fiecare poveste se leagă de cele mai puternice dovezi disponibile: surse originale atunci când sunt disponibile, altfel raportate atribuite în mod clar.
Engleză simplă
Ce s-a întâmplat, de ce contează și ce să urmărești - fără jargon.
Fără umplutură
Când semnalul este subțire, nu publicăm nimic în loc să umplem feedul.
Mai multe povești
9 povestiriSecuritate
SEAG Paper Proposes Aliasing Sensitive Entities Before RAG Queries Reach External LLMs
A preprint posted to arXiv describes a framework that swaps sensitive names in queries and retrieved documents for aliases before sending them to a third-party model. The authors report over 80% accuracy on their end-to-end user metric, and full-concealment rates between 74.91% and 77.83% across three small models.arxiv.orgInovație
CABS+ Paper Reports Cheaper, Faster Model Merging Across 27 Datasets
A preprint posted to arXiv describes CABS+, a model-merging method that replaces grid search with a gradient-free coefficient search. The authors report double-digit performance gains over two baselines, under a quarter of one baseline's GPU memory, and roughly a 4x speedup over another.arxiv.orgInovație
Paper Proposes Retrieved "Lessons" to Improve Spatial Reasoning in Frozen Vision-Language Models
An arXiv preprint describes Spatial Memory Agent, which stores verified experience as text lessons retrieved at inference time, claiming gains across five spatial benchmarks and four vision-language models without changing model weights. It is under review; its abstract names no benchmarks, base models, or margins.arxiv.orgInovație
PROVE-RT Paper Reports 44.7% Success Generating Machine-Checked Real-Time Proofs
An arXiv preprint presents PROVE-RT, which uses retrieval and staged prompting to make large language models write PROSA/ROCQ proof scripts for real-time schedulability analysis. The authors report a 44.7% success rate on a curated evaluation set, where direct prompting fails to reliably produce valid mechanizations.arxiv.orgPolitică
Working Paper Asks Whether India's Consumer Law Can Cover AI Harms
A new arXiv working paper argues India's Consumer Protection Act, 2019 is broad enough to reach AI-related harms in principle, but that proving causation and assigning blame across the AI supply chain remain unresolved. Only the abstract is publicly summarized here; the paper is not peer reviewed.arxiv.orgInovație
Apple Paper propune dezînvățare mai ieftină la mașină, omitând datele cu influență redusă
O lucrare Apple Machine Learning Research susține că nu orice punct de date dintr-o solicitare de ștergere necesită eliminare activă. Folosind funcțiile de influență în sarcinile de limbaj și viziune, autorii spun că exemplele cu influență scăzută pot fi eliminate din setul de uitare, reducând calculul dezînvățat cu până la aproximativ 50 la sută.machinelearning.apple.comInovație
AutoWorldModel-Bench testează dacă agenții de codificare pot îmbunătăți modelele lumii
Un nou arXiv preprint introduce un punct de referință pentru evaluarea agenților de codare ca cercetători de modele mondiale deschise în opt medii de joc, raportând îmbunătățiri în 63 din 64 de sesiuni.arxiv.orgInovație
Lucrarea Distribird descrie agenții AI bazați pe literatură pentru modelele Bayesian Priors
Un preprint arXiv prezintă Distribird, o aplicație cu mai mulți agenți care caută literatura științifică, extrage valorile parametrilor raportate și construiește distribuții anterioare urmăribile pentru calibrarea modelului bayesian.arxiv.orgInovație
Cercetătorii introduc OmniLens pentru interpretabilitatea modelelor lingvistice la scară largă
O nouă lucrare arXiv descrie OmniLens, o metodă cu costuri mai mici pentru examinarea semnalelor interne pe modele de limbaj mari și pentru identificarea locului în care apar comportamentele față de locul în care funcționează intervențiile.arxiv.org
Un briefing util în fiecare săptămână
Ține pasul cu AI fără a trăi în feed.
Obțineți știrile verificate de AI din săptămână, date originale, instrumente utile, alegeri de învățare și noi locuri de muncă AI.
Ajungeți la oamenii care învață AI
Angajați un profesionist AI sau lansați un produs AI util? Pune-o în fața oamenilor care au venit aici să învețe și să acționeze.
Postați un job AITrimiteți un instrument AI