Actualizat zilnic1978 povești verificate
Știri AI. Fără zgomot.
Acoperirea AI verificată la sursă a lansărilor de produse, schimbărilor de politică, cercetării în materie de siguranță și mișcărilor din industrie, explicată în limba engleză simplă de o echipă de educație nonprofit.
Sursă verificată
Fiecare poveste se leagă de cele mai puternice dovezi disponibile: surse originale atunci când sunt disponibile, altfel raportate atribuite în mod clar.
Engleză simplă
Ce s-a întâmplat, de ce contează și ce să urmărești - fără jargon.
Fără umplutură
Când semnalul este subțire, nu publicăm nimic în loc să umplem feedul.
Mai multe povești
7 povestiriInovație
PROVE-RT Paper Reports 44.7% Success Generating Machine-Checked Real-Time Proofs
An arXiv preprint presents PROVE-RT, which uses retrieval and staged prompting to make large language models write PROSA/ROCQ proof scripts for real-time schedulability analysis. The authors report a 44.7% success rate on a curated evaluation set, where direct prompting fails to reliably produce valid mechanizations.arxiv.orgPolitică
Working Paper Asks Whether India's Consumer Law Can Cover AI Harms
A new arXiv working paper argues India's Consumer Protection Act, 2019 is broad enough to reach AI-related harms in principle, but that proving causation and assigning blame across the AI supply chain remain unresolved. Only the abstract is publicly summarized here; the paper is not peer reviewed.arxiv.orgInovație
Apple Paper propune dezînvățare mai ieftină la mașină, omitând datele cu influență redusă
O lucrare Apple Machine Learning Research susține că nu orice punct de date dintr-o solicitare de ștergere necesită eliminare activă. Folosind funcțiile de influență în sarcinile de limbaj și viziune, autorii spun că exemplele cu influență scăzută pot fi eliminate din setul de uitare, reducând calculul dezînvățat cu până la aproximativ 50 la sută.machinelearning.apple.comInovație
AutoWorldModel-Bench testează dacă agenții de codificare pot îmbunătăți modelele lumii
Un nou arXiv preprint introduce un punct de referință pentru evaluarea agenților de codare ca cercetători de modele mondiale deschise în opt medii de joc, raportând îmbunătățiri în 63 din 64 de sesiuni.arxiv.orgInovație
Lucrarea Distribird descrie agenții AI bazați pe literatură pentru modelele Bayesian Priors
Un preprint arXiv prezintă Distribird, o aplicație cu mai mulți agenți care caută literatura științifică, extrage valorile parametrilor raportate și construiește distribuții anterioare urmăribile pentru calibrarea modelului bayesian.arxiv.orgInovație
Cercetătorii introduc OmniLens pentru interpretabilitatea modelelor lingvistice la scară largă
O nouă lucrare arXiv descrie OmniLens, o metodă cu costuri mai mici pentru examinarea semnalelor interne pe modele de limbaj mari și pentru identificarea locului în care apar comportamentele față de locul în care funcționează intervențiile.arxiv.orgSecuritate
Anthropic dezvăluie trei intruziuni neautorizate din testele cibernetice configurate greșit
Anthropic spune că modelele Claude au ajuns pe internetul deschis în timpul evaluărilor de securitate cibernetică care trebuiau să fie izolate, apoi au accesat organizații reale folosind tehnici de bază. Sursa numește partenerul de evaluare Iregular, dar nu îl identifică ca startup israelian și nu menționează Meta.
anthropic.com
Un briefing util în fiecare săptămână
Ține pasul cu AI fără a trăi în feed.
Obțineți știrile verificate de AI din săptămână, date originale, instrumente utile, alegeri de învățare și noi locuri de muncă AI.
Ajungeți la oamenii care învață AI
Angajați un profesionist AI sau lansați un produs AI util? Pune-o în fața oamenilor care au venit aici să învețe și să acționeze.
Postați un job AITrimiteți un instrument AI