Zpět na Novinky
PrůmyslInstruktáž AI Understanding

AWS a NVIDIA plánují 2 miliony dalších GPU pro agentní a fyzickou AI

AWS a NVIDIA uvádějí, že plánují nasadit 2 miliony dalších GPU NVIDIA v infrastruktuře AWS v letech 2027 a 2028 a zároveň rozšířit spolupráci v oblasti CPU, sítí, otevřených modelů, zpracování dat a robotiky.

5 min readRead the primary source
Primary-source image accompanying AWS and NVIDIA plan 2 million more GPUs for agentic and physical AI
Primární zdrojový dokumentZdroj zaznamenán
Vydavatel
nvidianews.nvidia.com
Odkaz na zdroj
nvidianews.nvidia.comhttps://nvidianews.nvidia.com/news/aws-and-nvidia-to-deliver-2-million-additional-gpus-and-next-generation-infrastructure-for-agentic-and-physical-ai
Typ zdroje
Primární dokument — oficiální oznámení, papír, podání nebo stránka první strany, kterou čteme přímo.
KontextPochopte to za 60 sekund

Začněte zde

Klíčové pojmy

RAG (generace rozšířeného vyhledávání)
Metoda, která získává externí znalosti a dodává je do generace v době odvození.
Paměť (paměť agenta)
Uložený kontext, který agent AI používá v krocích nebo relacích ke zlepšení kontinuity.
Sémantické vyhledávání
Vyhledávání, které odpovídá významu spíše než přesnému překrývání klíčových slov, často pomocí vkládání.
Otestujte seKvíz AI agentů

Co se stalo

AWS a NVIDIA oznámily rozšířenou strategickou spolupráci zaměřenou na zvýšení výpočetní kapacity AI a integraci více hardwaru a softwaru NVIDIA se službami AWS. Společnosti uvádějí, že AWS plánuje v letech 2027 a 2028 nasadit 2 miliony dalších GPU NVIDIA Blackwell Ultra, Rubin a Rubin Ultra do své globální infrastruktury, včetně továren na umělou inteligenci a kapacity pro agentní AI, vědecké objevy, podnikovou automatizaci a fyzickou zátěž AI.

AWS a NVIDIA uvedli, že rozšiřují 16letou spolupráci, aby uspokojili to, co popisují jako zrychlení poptávky po infrastruktuře AI. Ústředním závazkem je plán pro AWS nasadit 2 miliony dalších GPU NVIDIA v rámci své globální infrastruktury během let 2027 a 2028. Plánované systémy zahrnují GPU NVIDIA Blackwell Ultra, Rubin a Rubin Ultra s kapacitou určenou pro pracovní zátěž zahrnující agenty AI a fyzické objevy, podnikovou automatizaci AI. Protože oznámení používá jazyk budoucího času, popisuje plánované nasazení spíše než dokončenou instalaci nebo aktuálně dostupný inventář.

Společnosti také uvedly, že AWS rozšíří svou kapacitu NVIDIA Blackwell, včetně GPU RTX PRO 4500 Blackwell Server Edition pro instance Amazon EC2 G7. NVIDIA a AWS uvádějí, že instance G7 poskytují 4,6krát vyšší výkon odvození AI a 2,1krát vyšší grafický výkon než instance G6 předchozí generace. To jsou tvrzení v prohlášení společností; zdroj neidentifikuje testovací podmínky, pracovní vytížení, ceny nebo nezávislé ověření za porovnáváním. AWS je popisován jako první velký cloudový poskytovatel, který podle vydání nabízí instance akcelerované RTX PRO 4500.

Širší spolupráce pokrývá několik vrstev zásobníku AI. AWS a NVIDIA uvedli, že pracují na zavedení infrastruktury založené na procesoru NVIDIA Vera do AWS, rozšíření NVLink Fusion o vlastní širokopásmovou paměťovou technologii NVIDIA ve spolupráci s dodavateli pamětí a integraci platformy ZXQAIUtro2QXZAI’s ZXQAIUtro2QXA’s. Adaptér na látku. Plánují také pokračovat v nabízení otevřených modelů NVIDIA Nemotron prostřednictvím Amazon Bedrock a Amazon SageMaker, urychlit zpracování dat a vektorovou indexaci prostřednictvím knihoven NVIDIA CUDA-X na Amazon EMR a ZXQAIU1UQXZ Workload pomocí ZXQAIUQXZ OpenSearch a pokročilé robotické práce ZXXX Robotické využití fyzické platformy umělé inteligence NVIDIA.

Podrobnosti o zdroji: nvidianews.nvidia.com ↗

Proč na tom záleží

Oznámení by rozšířilo cloudovou infrastrukturu dostupnou pro rozsáhlý vývoj a nasazení AI, ale je to především plán zaměřený na budoucnost, spíše než důkaz, že kapacita již byla dodána. Propojuje také infrastrukturu AI s vládními úkoly, zpracováním podnikových dat a robotikou, čímž rozšiřuje partnerství za hranice samotných GPU.

Pokud bude dodatečná kapacita dodána, mohla by ovlivnit, jak rychle organizace přesunou projekty AI z experimentování do produkce. Vydání konkrétně rámuje rozšíření kolem agentních systémů, které mohou vyžadovat opakovaná volání modelu a podpůrnou datovou infrastrukturu, a fyzickou umělou inteligenci, která může vyžadovat simulaci, školení a ověřování. Poukazuje také na vědecké a podnikové využití, což naznačuje, že zamýšlené publikum přesahuje malý počet hraničních laboratoří. Zdroj neurčuje, kolik z plánované kapacity bude k dispozici běžným cloudovým zákazníkům ani jak bude přístup přidělen.

Oznámení je významné, protože spojuje dodávku hardwaru, nasazení cloudu a integraci softwaru do jednoho komerčního uspořádání. Zákazníci AWS by v zásadě mohli používat GPU NVIDIA spolu s vlastním křemíkem AWS a CPU NVIDIA Vera, zatímco NVLink Fusion by mohl propojit komponenty NVIDIA a Trainium v ​​rámci společné architektury v racku. Společnosti to popisují jako způsob podpory heterogenní infrastruktury AI. To může vývojářům poskytnout více možností pro přizpůsobení různých pracovních zátěží různým procesorům, ale zdroj neposkytuje nezávislé benchmarky porovnávající smíšené konfigurace s alternativami ani nevysvětluje technické limity přesunu zátěže mezi nimi.

Vládní složka zvyšuje podíly veřejného zájmu. AWS a NVIDIA uvedly, že plánují vybudovat továrny na umělou inteligenci pro americkou vládu, včetně 100 000 GPU na zabezpečené infrastruktuře AWS pro federální a národní bezpečnostní úlohy na úrovni dopadu 6 a vyšší. Tato verze neuvádí agentury, programy, místa nasazení, rozpočty, časové osy ani konkrétní úkoly, které by tyto systémy vykonávaly. Stanoví proto stanovený závazek k infrastruktuře, nikoli důkaz o konkrétním zavedení národní bezpečnosti nebo posouzení jeho důsledků. Plánované využití také činí bezpečnost, dohled nad nákupem a zvládání citlivých pracovních zátěží důležitými oblastmi pro další reporting.

Interactive Mechanism

Interaktivní mechanismus: Jak to vlastně funguje

Interaktivně prozkoumejte základní technologii tohoto vývoje.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Interaktivní kontrola konceptu+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Na co se dále dívat

Klíčové otázky jsou, zda plánovaná kapacita GPU dorazí podle plánu, kde je nasazena, k čemu mají zákazníci přístup a za jakou cenu a zda nároky společností na výkon a efektivitu platí i při nezávislém produkčním využití. Vydání neposkytuje podrobný harmonogram implementace, závazky zákazníků, požadavky na napájení ani konkrétní federální programy.

Nejprve sledujte provádění proti cíli 2027–2028. Zdroj nerozděluje 2 miliony GPU na roční milníky, regiony, weby datových center nebo konkrétní množství produktů kromě jmen rodin Blackwell Ultra, Rubin a Rubin Ultra. Rovněž neuvádí, kolik kapacity bylo objednáno, financováno, instalováno nebo rezervováno pro zákazníky. Výroba, balení, síťování, dostupnost energie a změny v regulaci nebo kontrole exportu by mohly ovlivnit konečný rozsah, ale vydání nenabízí žádné důkazy na úrovni projektu o těchto otázkách.

Za druhé, prozkoumejte, zda se deklarovaná efektivita a výkon promítají do skutečného pracovního zatížení. AWS a NVIDIA hlásí až 3,7krát rychlejší zpracování dat a o 30 % lepší cenový výkon pro určité konfigurace Amazon EMR s akcelerací GPU a také až 9krát rychlejší vektorovou indexaci za čtvrtinu nákladů na Amazon OpenSearch. Zdroj nespecifikuje datové sady, základní linie, tvary zátěže, míry využití nebo celkové provozní náklady. Bylo by zapotřebí nezávislé testování, aby se zjistilo, jak reprezentativní jsou tato čísla pro zákazníky provozující generování s rozšířeným vyhledáváním, sémantické vyhledávání, rozsáhlé analýzy nebo jiné produkční aplikace.

Nakonec se podívejte na praktické uvedení modelů, zabezpečení a robotiky. Verze říká, že modely Nemotron budou dostupné prostřednictvím Bedrock a SageMaker, ale neuvádí nové názvy modelů, data vydání, ceny ani regionální dostupnost. Říká se, že Amazon Robotics a NVIDIA budou fungovat napříč simulacemi, generováním syntetických dat, školením robotů, optimalizací trasy, funkční bezpečností a validací v reálném čase, ale neoznamují konkrétního robota, zařízení, výsledek nasazení nebo hodnocení bezpečnosti. Nejdůležitější neznámou je, zda tyto integrace přinášejí měřitelné výhody pro zákazníky a ověřitelná ochranná opatření v rozsahu, který společnosti popisují.

Související průvodci a kvízy

Agenti AIVysvětlení modelů AIŠkolení AIBudoucnost AIOtestujte si, co víte – vyzkoušejte bezplatný kvíz AIVyhledejte si termín AI v našem slovníkuSledujte sledovač financování AI
Považujete to za užitečné?