Inasasishwa kila siku2273 Hadithi zilizothibitishwa
Habari za AI. Bila kelele.
Chanjo ya AI iliyokaguliwa na chanzo ya uzinduzi wa bidhaa, mabadiliko ya sera, utafiti wa usalama, na hatua za tasnia, zilizofafanuliwa kwa Kiingereza wazi na timu ya elimu isiyo ya faida.
Upatikanaji uliothibitishwa
Kila hadithi inaunganisha na ushahidi wenye nguvu zaidi unaopatikana: vyanzo vya asili vinapopatikana, vinginevyo vinahusishwa wazi.
Kiingereza wazi
Nini kilitokea, kwa nini ni muhimu, na nini cha kutazama - bila jargon.
Hakuna kichungi
Wakati ishara ni nyembamba, hatuchapishi chochote badala ya kuweka malisho.
Hadithi zaidi
9 HadithiUbunifu
Benchmark Inasema Miundo ya Juu ya Miundo mingi Hupata Chini ya 10% katika Kusoma Maneno Kutoka kwa Sauti za Kalamu na Mwendo wa Mkono
Karatasi mpya ya arXiv inatanguliza jaribio ambalo miundo lazima iandike neno lililoandikwa kutoka kwa sauti ya mkwaruzo wa kalamu na video ya kusogeza kwa mkono, bila wino unaoonekana. Waandishi wanaripoti kuwa watu walio juu ya 80% ya usahihi wa herufi zilizoagizwa na miundo bora chini ya 10% - na kwamba kutoa miundo mbinu zote mbili mara nyingi kulifanya matokeo kuwa mabaya zaidi.arxiv.orgUbunifu
Karatasi Inasema Usimamizi wa Akiba Unaofahamu Wakala Unapunguza Ucheleweshaji wa Ishara ya Kwanza Hadi 45% katika Utoaji wa Mawakala Wengi
Chapisho mpya ya awali ya arXiv inafafanua CacheScout, safu iliyojengwa kwenye seva ya chanzo huria ya vLLM ambayo huamua nini cha kuweka kwenye akiba ya thamani ya ufunguo ya kielelezo kulingana na wakala gani anayefuata. Waandishi wanaripoti latency ya tarakimu mbili na mafanikio ya matokeo; mzigo wa kazi, miundo, na maunzi hayajasemwa katika mukhtasari.arxiv.orgUbunifu
Ukaguzi wa Uthibitisho Unaozalishwa na OpenAI AI Unapata Hali Iliyobadilishwa, na Kuchapisha Urekebishaji.
Watafiti wawili wanasema uthibitisho wa lemma katika Sura ya 6 ya hati ya hisabati ya OpenAI ina hitilafu ya polarity: mtihani katika suala la mafanikio ya wastani ambapo hatua inayofuata inahitaji kushindwa kwa masharti makubwa. Wanatoa mfano wa kupingana na uthibitisho uliosahihishwa, na kuonya kwamba hii sio uthibitishaji wa nadharia kuu ya sura.arxiv.orgUbunifu
Utafiti wa Kurudufisha Unasema FLOPs Bado Inapotosha AI Runtime, na Urekebishaji Unaopendekezwa Umeshindwa kwenye Vifaa Vipya zaidi.
Chapisho la awali la watafiti wawili hutoa tena utafiti wa awali kuhusu kwa nini hesabu sawa za FLOP haimaanishi muda sawa wa utekelezaji. Inathibitisha dai la msingi lakini inaripoti kuwa fomula ya kusahihisha ya α-FLOPs kwa ujumla inakadiria muda wa utekelezaji wa maunzi mapya zaidi, ambayo yanaonyesha mirukaji na mizunguko ambayo fomula haichukui.arxiv.orgBiashara
Karatasi ya Benchmark Inapata Njia Nne za Kuuliza Data ya Biashara Na LLM Zote Zimepata Chini ya 26%
Chapisho mpya ya awali ya arXiv inahusisha usanifu nne wa uulizaji wa lugha asilia wa hifadhidata za biashara dhidi ya kila mmoja kwenye kigezo cha sintetiki cha lugha mbili. Hakuna aliyejibu zaidi ya robo ya kesi kwa usahihi, na muundo uliopata alama za juu zaidi haukuwa salama zaidi au wa bei nafuu zaidi.arxiv.orgUbunifu
Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Model
A new arXiv preprint argues security teams can judge whether a memory- or retrieval-equipped AI agent is learning by measuring how far it closes the gap to a stronger "teacher" model, rather than on labeled benchmarks that are often scarce or stale. Judging by a similarly powered model gave no usable signal.arxiv.orgUbunifu
New Benchmark Tests Whether AI Assistants Can Remember a Year of Phone Use
A 17-author technical report posted to arXiv introduces MobileMem, a benchmark and framework for on-device long-term memory built from a year-scale collection of mobile experiences. The abstract describes the design but reports no scores, and key details about the underlying data remain undisclosed.arxiv.orgUbunifu
Karatasi Inaripoti Ubongo-Kama Shirika la Kawaida Linaloibuka Ndani ya Miundo Kubwa ya Lugha
Machapisho mapya ya arXiv yanasema miundo mikubwa ya lugha hutengeneza muundo wa ndani unaofanya kazi ambao unalingana na mitandao tofauti ya ubongo wa binadamu, kulingana na uchanganuzi wa mzunguko katika kazi 46 katika nyanja nne za utambuzi. Ukurasa wa mukhtasari huacha maelezo muhimu ya kimbinu bila kutajwa.arxiv.orgUbunifu
Paper Finds Late Layers of a Mixture-of-Experts Model Tolerate Heavy Expert Masking
A preprint reports that disabling low-magnitude experts in the last five layers of a 35-billion-parameter Mixture-of-Experts model preserved far more usable code-translation outputs than spreading the same cuts across all layers. It covers one model and one benchmark, and the abstract reports no unmasked baseline.arxiv.org
Muhtasari mmoja muhimu kila wiki
Endelea na AI bila kuishi kwenye mipasho.
Pata habari za AI zilizothibitishwa za wiki, data asili, zana muhimu, chaguo za kujifunza na kazi mpya za AI.
Fikia watu wanaojifunza AI
Kuajiri mtaalamu wa AI au kuzindua bidhaa muhimu ya AI? Iweke mbele ya watu waliokuja hapa kujifunza na kuchukua hatua.
Chapisha kazi ya AIPeana zana ya AI