Actualizat zilnic2127 povești verificate
Știri AI. Fără zgomot.
Acoperirea AI verificată la sursă a lansărilor de produse, schimbărilor de politică, cercetării în materie de siguranță și mișcărilor din industrie, explicată în limba engleză simplă de o echipă de educație nonprofit.
Sursă verificată
Fiecare poveste se leagă de cele mai puternice dovezi disponibile: surse originale atunci când sunt disponibile, altfel raportate atribuite în mod clar.
Engleză simplă
Ce s-a întâmplat, de ce contează și ce să urmărești - fără jargon.
Fără umplutură
Când semnalul este subțire, nu publicăm nimic în loc să umplem feedul.
Mai multe povești
9 povestiriInovație
Paper Argues Evolution Strategies Beat RL at Keeping LLM Answer Sets Diverse
A new arXiv preprint argues that post-training LLMs with evolution strategies — a population-based, gradient-free method that perturbs weights directly — beats reinforcement learning on pass@k and solution coverage. The abstract cites better math-benchmark results but names no models, benchmarks, or numbers.arxiv.orgSecuritate
Paper Says Self-Improving AI Agents Can Turn One Unsafe Success Into a Reusable Skill
A new arXiv preprint benchmarks a specific agent failure mode: when a self-improving agent writes an unsafe procedure into memory, it can be retrieved and executed in later sessions. Every evolved configuration tested produced unsafe artifacts, and three malicious tasks more than doubled carryover attack success.arxiv.orgSecuritate
Documentul SEAG propune aliasarea entităților sensibile înainte ca interogările RAG să ajungă la LLM-uri externe
Un preprint postat pe arXiv descrie un cadru care schimbă nume sensibile în interogări și documente preluate pentru aliasuri înainte de a le trimite la un model terță parte. Autorii raportează o acuratețe de peste 80% pentru valorile lor end-to-end de utilizator și rate de ascundere completă între 74,91% și 77,83% pentru trei modele mici.arxiv.orgInovație
CABS+ Paper Reports Cheaper, Faster Model Merging Across 27 Datasets
A preprint posted to arXiv describes CABS+, a model-merging method that replaces grid search with a gradient-free coefficient search. The authors report double-digit performance gains over two baselines, under a quarter of one baseline's GPU memory, and roughly a 4x speedup over another.arxiv.orgInovație
Paper Proposes Retrieved "Lessons" to Improve Spatial Reasoning in Frozen Vision-Language Models
An arXiv preprint describes Spatial Memory Agent, which stores verified experience as text lessons retrieved at inference time, claiming gains across five spatial benchmarks and four vision-language models without changing model weights. It is under review; its abstract names no benchmarks, base models, or margins.arxiv.orgInovație
PROVE-RT Paper Reports 44.7% Success Generating Machine-Checked Real-Time Proofs
An arXiv preprint presents PROVE-RT, which uses retrieval and staged prompting to make large language models write PROSA/ROCQ proof scripts for real-time schedulability analysis. The authors report a 44.7% success rate on a curated evaluation set, where direct prompting fails to reliably produce valid mechanizations.arxiv.orgPolitică
Working Paper Asks Whether India's Consumer Law Can Cover AI Harms
A new arXiv working paper argues India's Consumer Protection Act, 2019 is broad enough to reach AI-related harms in principle, but that proving causation and assigning blame across the AI supply chain remain unresolved. Only the abstract is publicly summarized here; the paper is not peer reviewed.arxiv.orgInovație
Apple Paper propune dezînvățare mai ieftină la mașină, omitând datele cu influență redusă
O lucrare Apple Machine Learning Research susține că nu orice punct de date dintr-o solicitare de ștergere necesită eliminare activă. Folosind funcțiile de influență în sarcinile de limbaj și viziune, autorii spun că exemplele cu influență scăzută pot fi eliminate din setul de uitare, reducând calculul dezînvățat cu până la aproximativ 50 la sută.machinelearning.apple.comInovație
AutoWorldModel-Bench testează dacă agenții de codificare pot îmbunătăți modelele lumii
Un nou arXiv preprint introduce un punct de referință pentru evaluarea agenților de codare ca cercetători de modele mondiale deschise în opt medii de joc, raportând îmbunătățiri în 63 din 64 de sesiuni.arxiv.org
Un briefing util în fiecare săptămână
Ține pasul cu AI fără a trăi în feed.
Obțineți știrile verificate de AI din săptămână, date originale, instrumente utile, alegeri de învățare și noi locuri de muncă AI.
Ajungeți la oamenii care învață AI
Angajați un profesionist AI sau lansați un produs AI util? Pune-o în fața oamenilor care au venit aici să învețe și să acționeze.
Postați un job AITrimiteți un instrument AI