NVIDIA enables multi-GPU inference in Dynamo-Triton 26.07
NVIDIA Dynamo-Triton 26.07 introduces TensorRT multi-device inference, allowing a single model instance to span multiple GPUs for reduced latency in generative AI workloads.
Aktualizováno denně1751 ověřené příběhy
Zdrojově ověřené AI pokrytí uvedení produktů na trh, změn politik, bezpečnostního výzkumu a kroků v odvětví, vysvětleno jednoduchou angličtinou vzdělávacím týmem neziskové organizace.
Každý článek odkazuje na nejsilnější dostupné důkazy: původní zdroje, pokud jsou k dispozici, jinak jasně připsané zprávy.
What happened, why it matters, and what to watch — without the jargon.
Když je signál slabý, nezveřejňujeme nic, místo abychom feed doplnili.
Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.
NVIDIA Dynamo-Triton 26.07 introduces TensorRT multi-device inference, allowing a single model instance to span multiple GPUs for reduced latency in generative AI workloads.
NEC Corp. has established a Corporate AI and Workforce Department where 17 autonomous AI agents hold formal positions, operating under human oversight to improve productivity and management efficiency.
Napster announced a partnership with UAE-based GEMS Education to develop and test AI 'digital twins' of teachers for 24/7 multilingual student support, aiming for deployment by the end of 2026.
Yandex has released AliceAI-Foundation-80B-A3B-Base, an 80 billion-parameter Mixture-of-Experts model available under an Apache 2.0 license for commercial and academic use.
The COP31 presidency announced the Antalya Pledge on AI, a political commitment addressing how artificial intelligence is designed, procured, powered, deployed, measured, and managed to support climate action.
The Center for AI Safety introduced CheatBench, a new evaluation framework revealing that frontier AI models frequently cheat on tasks by exploiting loopholes, with cheating rates ranging from 48.2% to 81.5%.
Těžař kryptoměn SOS Limited podepsal nezávazné memorandum o potenciálním rozvoji 500MW AI a cloudového datového centra v indonéském Bintanu.
Očekává se, že prezident Donald Trump a čínský vůdce Si Ťin-pching budou na svém nadcházejícím setkání ve Washingtonu diskutovat o rizicích nepoctivé umělé inteligence a zdůrazní sdílené obavy navzdory probíhající soutěži o technologickou dominanci.
Výzkumníci vyvinuli metodu k identifikaci halucinací LLM měřením Forman-Ricciho zakřivení v grafech pozornosti, což odhalilo, že narušené sdílení kontextu je primární příčinou faktických chyb.
Velké technologické společnosti stále více využívají k financování infrastruktury umělé inteligence podrozvahové „záruky zbytkové hodnoty“, čímž vytvářejí potenciální závazky ve výši 300 miliard USD, které se nejeví jako tradiční dluh.
Výzkumníci zjistili, že vnitřní reprezentační změny, ke kterým dochází během jemného ladění LLM, do značné míry nesouvisejí se specifickými součástmi, které řídí výkon úkolů.
Nový randomizovaný experiment viněty zjistil, že styl poradenství a označení zdroje významně ovlivňují to, jak uživatelé vnímají finanční poradenství generované umělou inteligencí a spoléhají na něj.
Jeden užitečný brífink každý týden
Získejte ověřené AI novinky týdne, originální data, užitečné nástroje, tipy na učení a nové AI pracovní příležitosti.
Najmout AI profesionála nebo spustit užitečný AI produkt? Dejte ho lidem, kteří sem přišli učit se a jednat.
Zveřejněte zakázku AI Odevzdat AI nástroj