Inasasishwa kila siku1982 Hadithi zilizothibitishwa
Habari za AI. Bila kelele.
Chanjo ya AI iliyokaguliwa na chanzo ya uzinduzi wa bidhaa, mabadiliko ya sera, utafiti wa usalama, na hatua za tasnia, zilizofafanuliwa kwa Kiingereza wazi na timu ya elimu isiyo ya faida.
Upatikanaji uliothibitishwa
Kila hadithi inaunganisha na ushahidi wenye nguvu zaidi unaopatikana: vyanzo vya asili vinapopatikana, vinginevyo vinahusishwa wazi.
Kiingereza wazi
Nini kilitokea, kwa nini ni muhimu, na nini cha kutazama - bila jargon.
Hakuna kichungi
Wakati ishara ni nyembamba, hatuchapishi chochote badala ya kuweka malisho.
Hadithi zaidi
9 HadithiUbunifu
Utafiti wa Kurudufisha Unasema FLOPs Bado Inapotosha AI Runtime, na Urekebishaji Unaopendekezwa Umeshindwa kwenye Vifaa Vipya zaidi.
Chapisho la awali la watafiti wawili hutoa tena utafiti wa awali kuhusu kwa nini hesabu sawa za FLOP haimaanishi muda sawa wa utekelezaji. Inathibitisha dai la msingi lakini inaripoti kuwa fomula ya kusahihisha ya α-FLOPs kwa ujumla inakadiria muda wa utekelezaji wa maunzi mapya zaidi, ambayo yanaonyesha mirukaji na mizunguko ambayo fomula haichukui.arxiv.orgBiashara
Karatasi ya Benchmark Inapata Njia Nne za Kuuliza Data ya Biashara Na LLM Zote Zimepata Chini ya 26%
Chapisho mpya ya awali ya arXiv inahusisha usanifu nne wa uulizaji wa lugha asilia wa hifadhidata za biashara dhidi ya kila mmoja kwenye kigezo cha sintetiki cha lugha mbili. Hakuna aliyejibu zaidi ya robo ya kesi kwa usahihi, na muundo uliopata alama za juu zaidi haukuwa salama zaidi au wa bei nafuu zaidi.arxiv.orgUbunifu
Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Model
A new arXiv preprint argues security teams can judge whether a memory- or retrieval-equipped AI agent is learning by measuring how far it closes the gap to a stronger "teacher" model, rather than on labeled benchmarks that are often scarce or stale. Judging by a similarly powered model gave no usable signal.arxiv.orgUbunifu
New Benchmark Tests Whether AI Assistants Can Remember a Year of Phone Use
A 17-author technical report posted to arXiv introduces MobileMem, a benchmark and framework for on-device long-term memory built from a year-scale collection of mobile experiences. The abstract describes the design but reports no scores, and key details about the underlying data remain undisclosed.arxiv.orgUbunifu
Karatasi Inaripoti Ubongo-Kama Shirika la Kawaida Linaloibuka Ndani ya Miundo Kubwa ya Lugha
Machapisho mapya ya arXiv yanasema miundo mikubwa ya lugha hutengeneza muundo wa ndani unaofanya kazi ambao unalingana na mitandao tofauti ya ubongo wa binadamu, kulingana na uchanganuzi wa mzunguko katika kazi 46 katika nyanja nne za utambuzi. Ukurasa wa mukhtasari huacha maelezo muhimu ya kimbinu bila kutajwa.arxiv.orgUbunifu
Paper Finds Late Layers of a Mixture-of-Experts Model Tolerate Heavy Expert Masking
A preprint reports that disabling low-magnitude experts in the last five layers of a 35-billion-parameter Mixture-of-Experts model preserved far more usable code-translation outputs than spreading the same cuts across all layers. It covers one model and one benchmark, and the abstract reports no unmasked baseline.arxiv.orgUsalama
Makosa ya CoreBreak Ruhusu Zana za Wakala Iendeshe Bila Modeli Kuwahi Kuitwa
Dokezo la utafiti la Cloud Security Alliance linafafanua CoreBreak, muundo wa dosari katika Amazon Bedrock AgentCore, Google's Development Agent Kit, na Vercel's AI SDK furushi ambazo ziliruhusu zana kutekeleza bila zamu ya kielelezo - na kuacha ngome za ulinzi bila chochote.labs.cloudsecurityalliance.orgSera
Anthropic Details How Claude's Text Watermark Will Work
Anthropic says future Claude models will embed a statistical watermark based on Google DeepMind's SynthID-Text, to comply with the EU AI Act. The company says it adds no characters, tokens, or user identity — and that a full rewrite defeats it.
anthropic.comViwanda
Cursor Says Its Acquisition by SpaceX Has Officially Closed
Cursor published a short post saying SpaceX has completed its acquisition of the AI coding tool, finishing a process it says began in April with a model-training partnership with SpaceXAI. The post promises access to what it calls the world's largest GPU fleet, but discloses no terms, timelines, or product changes.
cursor.com
Muhtasari mmoja muhimu kila wiki
Endelea na AI bila kuishi kwenye mipasho.
Pata habari za AI zilizothibitishwa za wiki, data asili, zana muhimu, chaguo za kujifunza na kazi mpya za AI.
Fikia watu wanaojifunza AI
Kuajiri mtaalamu wa AI au kuzindua bidhaa muhimu ya AI? Iweke mbele ya watu waliokuja hapa kujifunza na kuchukua hatua.
Chapisha kazi ya AIPeana zana ya AI