Назад към Новини
ИндустрияAI Understanding брифинг

AWS и NVIDIA планират още 2 милиона GPU за агентен и физически AI

AWS и NVIDIA казват, че планират да разположат 2 милиона допълнителни NVIDIA графични процесора в AWS инфраструктурата през 2027 г. и 2028 г., като същевременно разширяват сътрудничеството за процесори, мрежи, отворени модели, обработка на данни и роботика.

5 min readRead the primary source
Primary-source image accompanying AWS and NVIDIA plan 2 million more GPUs for agentic and physical AI
Документ с първичен източникИзточникът е записан
Издател
nvidianews.nvidia.com
Изходна връзка
nvidianews.nvidia.comhttps://nvidianews.nvidia.com/news/aws-and-nvidia-to-deliver-2-million-additional-gpus-and-next-generation-infrastructure-for-agentic-and-physical-ai
Тип източник
Първичен документ — официално съобщение, документ, документ или първа страна, която четем директно.
КонтекстРазберете това за 60 секунди

Започнете тук

Ключови термини

RAG (генериране с допълнено извличане)
Метод, който извлича външно знание и го захранва за генериране по време на извод.
Памет (памет на агент)
Съхраненият контекст, който AI агент използва през стъпките или сесиите, за да подобри непрекъснатостта.
Семантично търсене
Търсене, което съответства на значението, а не точното припокриване на ключови думи, често използвайки вграждания.
Тествайте себе сиAI Агенти Викторина

Какво стана

AWS и NVIDIA обявиха разширено стратегическо сътрудничество, насочено към увеличаване на изчислителния капацитет на AI и интегриране на повече от хардуера и софтуера на NVIDIA с услугите на AWS. Компаниите казват, че AWS планира да внедри 2 милиона допълнителни GPU NVIDIA Blackwell Ultra, Rubin и Rubin Ultra в своята глобална инфраструктура през 2027 г. и 2028 г., включително AI фабрики и капацитет за агентен AI, научни открития, корпоративна автоматизация и физически натоварвания на AI.

AWS и NVIDIA казаха, че разширяват 16-годишно сътрудничество, за да отговорят на това, което описват като ускоряващо се търсене на AI инфраструктура. Основният ангажимент е план за AWS да внедри 2 милиона допълнителни NVIDIA GPU в своята глобална инфраструктура през 2027 и 2028 г. Планираните системи включват NVIDIA Blackwell Ultra, Rubin и Rubin Ultra GPU с капацитет, предназначен за работни натоварвания, включващи AI агенти, научни открития, корпоративна автоматизация и физически AI. Тъй като съобщението използва език в бъдеще време, то описва планирано внедряване, а не завършена инсталация или наличен в момента инвентар.

Компаниите също така казаха, че AWS ще разшири своя капацитет NVIDIA Blackwell, включително графични процесори RTX PRO 4500 Blackwell Server Edition за Amazon EC2 G7 инстанции. NVIDIA и AWS заявяват, че инстанциите на G7 осигуряват 4,6 пъти по-висока производителност на изводи от AI и 2,1 пъти по-висока графична производителност от инстанциите от предишно поколение G6. Това са твърдения в съобщението на компаниите; източникът не идентифицира тестовите условия, работните натоварвания, цените или независимото валидиране зад сравненията. AWS е описан като първия голям облачен доставчик, който предлага инстанции, ускорени от RTX PRO 4500, според изданието.

По-широкото сътрудничество обхваща няколко слоя от AI стека. AWS и NVIDIA казаха, че работят за въвеждане на NVIDIA Vera CPU-базирана инфраструктура към AWS, разширяване на NVLink Fusion с персонализираната технология за памет с висока честотна лента на NVIDIA в сътрудничество с доставчици на памет и интегриране на платформата на NVIDIA с AWS Nitro Система и адаптер за еластичен плат. Те също така планират да продължат да предлагат отворени модели NVIDIA Nemotron чрез Amazon Bedrock и Amazon SageMaker, да ускорят обработката на данни и векторното индексиране чрез NVIDIA CUDA-X библиотеки на Amazon EMR и Amazon OpenSearch и да усъвършенстват натоварванията на роботиката чрез Използването от Amazon Robotics на физическата AI платформа на NVIDIA.

Детайли за източника: nvidianews.nvidia.com ↗

Защо има значение

Съобщението ще разшири облачната инфраструктура, налична за широкомащабно разработване и внедряване на AI, но това е преди всичко план, насочен към бъдещето, а не доказателство, че капацитетът вече е доставен. Той също така свързва AI инфраструктурата с правителствените натоварвания, обработката на корпоративни данни и роботиката, разширявайки партньорството отвъд само инстанциите на GPU.

Ако бъде доставен, допълнителният капацитет може да повлияе на това колко бързо организациите преместват AI проекти от експериментиране в производство. Изданието специално очертава разширяването около агентните системи, които може да изискват повтарящи се извиквания на модели и поддържаща инфраструктура за данни, и физически AI, който може да изисква натоварвания за симулация, обучение и валидиране. Той също така посочва научни и корпоративни употреби, което предполага, че целевата аудитория се простира отвъд малък брой гранични лаборатории. Източникът не установява каква част от планирания капацитет ще бъде достъпна за обикновените клиенти на облака или как ще бъде разпределен достъпът.

Съобщението е важно, защото съчетава доставка на хардуер, внедряване в облака и софтуерна интеграция в едно търговско споразумение. Клиентите на AWS по принцип ще могат да използват NVIDIA графични процесори заедно с AWS потребителски силиций и NVIDIA Vera процесори, докато NVLink Fusion може да свърже NVIDIA и Trainium компоненти в рамките на обща архитектура на стелаж. Компаниите описват това като начин за поддържане на хетерогенна AI инфраструктура. Това може да даде на разработчиците повече възможности за съпоставяне на различни работни натоварвания към различни процесори, но източникът не предоставя независими бенчмаркове, сравняващи смесени конфигурации с алтернативи, или обяснява инженерните ограничения на преместването на работни натоварвания между тях.

Правителственият компонент повишава залога на обществения интерес. AWS и NVIDIA заявиха, че планират да изградят AI фабрики за правителството на САЩ, включително 100 000 графични процесора върху защитена AWS инфраструктура за федерални и национални работни натоварвания на ниво на въздействие 6 и по-високо. Изданието не посочва агенции, програми, сайтове за внедряване, бюджети, срокове или конкретните задачи, които тези системи биха изпълнявали. Следователно той установява заявен инфраструктурен ангажимент, а не доказателство за конкретно разгръщане на националната сигурност или оценка на последиците от него. Планираното използване също прави сигурността, надзора на доставките и обработката на чувствителни работни натоварвания важни области за по-нататъшно отчитане.

Interactive Mechanism

Интерактивен механизъм: как всъщност работи

Разгледайте интерактивно основната технология зад тази разработка.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Интерактивна проверка на концепцията+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Какво да гледате след това

Ключовите въпроси са дали планираният капацитет на GPU пристига по график, къде е разгърнат, до какво имат достъп клиентите и на каква цена и дали претенциите на компаниите за производителност и ефективност се поддържат при независима производствена употреба. Изданието не предоставя подробен график за внедряване, ангажименти на клиентите, изисквания за захранване или специфични федерални програми.

Първо, наблюдавайте изпълнението спрямо целта за 2027–2028 г. Източникът не разделя 2-те милиона графични процесора на годишни етапи, региони, сайтове за центрове за данни или конкретни количества продукти, освен назоваването на семействата Blackwell Ultra, Rubin и Rubin Ultra. Също така не се казва колко капацитет е поръчан, финансиран, инсталиран или запазен за клиенти. Производството, опаковането, работата в мрежа, наличността на захранване и промените в регулаторния или експортния контрол могат да повлияят на крайния мащаб, но изданието не предлага доказателства на ниво проект по тези въпроси.

Второ, проучете дали заявената ефективност и производителност се превръщат в реални натоварвания. AWS и NVIDIA отчитат до 3,7 пъти по-бърза обработка на данни и 30% по-добра ценова производителност за определени GPU-ускорени Amazon EMR конфигурации, както и до 9 пъти по-бързо векторно индексиране на една четвърт от цената на Amazon OpenSearch. Източникът не уточнява наборите от данни, базовите линии, формите на работното натоварване, нивата на използване или общите оперативни разходи. Необходими са независими тестове, за да се определи колко представителни са тези цифри за клиенти, работещи с генериране с разширено извличане, семантично търсене, широкомащабни анализи или други производствени приложения.

И накрая, вижте практическото внедряване на модела, сигурността и роботиката. Изданието казва, че моделите на Nemotron ще бъдат достъпни чрез Bedrock и SageMaker, но не дава нови имена на модели, дати на пускане, цени или регионална наличност. В него се казва, че Amazon Robotics и NVIDIA ще работят в симулация, генериране на синтетични данни, обучение на роботи, оптимизиране на маршрута, функционална безопасност и валидиране от реално към SIM, но не обявява конкретен робот, съоръжение, резултат от внедряване или оценка на безопасността. Най-важното неизвестно е дали тези интеграции произвеждат измерими ползи за клиентите и проверими предпазни мерки в мащаба, описан от компаниите.

Свързани ръководства и викторини

AI агентиОбяснени модели на AIAI обучениеБъдещето на ИИТествайте какво знаете — опитайте безплатен тест с изкуствен интелектПотърсете термин за AI в нашия речникСледвайте инструмента за проследяване на финансиране на AI
Намирате ли това за полезно?