Какво стана
AWS и NVIDIA обявиха разширено стратегическо сътрудничество, насочено към увеличаване на изчислителния капацитет на AI и интегриране на повече от хардуера и софтуера на NVIDIA с услугите на AWS. Компаниите казват, че AWS планира да внедри 2 милиона допълнителни GPU NVIDIA Blackwell Ultra, Rubin и Rubin Ultra в своята глобална инфраструктура през 2027 г. и 2028 г., включително AI фабрики и капацитет за агентен AI, научни открития, корпоративна автоматизация и физически натоварвания на AI.
AWS и NVIDIA казаха, че разширяват 16-годишно сътрудничество, за да отговорят на това, което описват като ускоряващо се търсене на AI инфраструктура. Основният ангажимент е план за AWS да внедри 2 милиона допълнителни NVIDIA GPU в своята глобална инфраструктура през 2027 и 2028 г. Планираните системи включват NVIDIA Blackwell Ultra, Rubin и Rubin Ultra GPU с капацитет, предназначен за работни натоварвания, включващи AI агенти, научни открития, корпоративна автоматизация и физически AI. Тъй като съобщението използва език в бъдеще време, то описва планирано внедряване, а не завършена инсталация или наличен в момента инвентар.
Компаниите също така казаха, че AWS ще разшири своя капацитет NVIDIA Blackwell, включително графични процесори RTX PRO 4500 Blackwell Server Edition за Amazon EC2 G7 инстанции. NVIDIA и AWS заявяват, че инстанциите на G7 осигуряват 4,6 пъти по-висока производителност на изводи от AI и 2,1 пъти по-висока графична производителност от инстанциите от предишно поколение G6. Това са твърдения в съобщението на компаниите; източникът не идентифицира тестовите условия, работните натоварвания, цените или независимото валидиране зад сравненията. AWS е описан като първия голям облачен доставчик, който предлага инстанции, ускорени от RTX PRO 4500, според изданието.
По-широкото сътрудничество обхваща няколко слоя от AI стека. AWS и NVIDIA казаха, че работят за въвеждане на NVIDIA Vera CPU-базирана инфраструктура към AWS, разширяване на NVLink Fusion с персонализираната технология за памет с висока честотна лента на NVIDIA в сътрудничество с доставчици на памет и интегриране на платформата на NVIDIA с AWS Nitro Система и адаптер за еластичен плат. Те също така планират да продължат да предлагат отворени модели NVIDIA Nemotron чрез Amazon Bedrock и Amazon SageMaker, да ускорят обработката на данни и векторното индексиране чрез NVIDIA CUDA-X библиотеки на Amazon EMR и Amazon OpenSearch и да усъвършенстват натоварванията на роботиката чрез Използването от Amazon Robotics на физическата AI платформа на NVIDIA.
Детайли за източника: nvidianews.nvidia.com ↗
Защо има значение
Съобщението ще разшири облачната инфраструктура, налична за широкомащабно разработване и внедряване на AI, но това е преди всичко план, насочен към бъдещето, а не доказателство, че капацитетът вече е доставен. Той също така свързва AI инфраструктурата с правителствените натоварвания, обработката на корпоративни данни и роботиката, разширявайки партньорството отвъд само инстанциите на GPU.
Ако бъде доставен, допълнителният капацитет може да повлияе на това колко бързо организациите преместват AI проекти от експериментиране в производство. Изданието специално очертава разширяването около агентните системи, които може да изискват повтарящи се извиквания на модели и поддържаща инфраструктура за данни, и физически AI, който може да изисква натоварвания за симулация, обучение и валидиране. Той също така посочва научни и корпоративни употреби, което предполага, че целевата аудитория се простира отвъд малък брой гранични лаборатории. Източникът не установява каква част от планирания капацитет ще бъде достъпна за обикновените клиенти на облака или как ще бъде разпределен достъпът.
Съобщението е важно, защото съчетава доставка на хардуер, внедряване в облака и софтуерна интеграция в едно търговско споразумение. Клиентите на AWS по принцип ще могат да използват NVIDIA графични процесори заедно с AWS потребителски силиций и NVIDIA Vera процесори, докато NVLink Fusion може да свърже NVIDIA и Trainium компоненти в рамките на обща архитектура на стелаж. Компаниите описват това като начин за поддържане на хетерогенна AI инфраструктура. Това може да даде на разработчиците повече възможности за съпоставяне на различни работни натоварвания към различни процесори, но източникът не предоставя независими бенчмаркове, сравняващи смесени конфигурации с алтернативи, или обяснява инженерните ограничения на преместването на работни натоварвания между тях.
Правителственият компонент повишава залога на обществения интерес. AWS и NVIDIA заявиха, че планират да изградят AI фабрики за правителството на САЩ, включително 100 000 графични процесора върху защитена AWS инфраструктура за федерални и национални работни натоварвания на ниво на въздействие 6 и по-високо. Изданието не посочва агенции, програми, сайтове за внедряване, бюджети, срокове или конкретните задачи, които тези системи биха изпълнявали. Следователно той установява заявен инфраструктурен ангажимент, а не доказателство за конкретно разгръщане на националната сигурност или оценка на последиците от него. Планираното използване също прави сигурността, надзора на доставките и обработката на чувствителни работни натоварвания важни области за по-нататъшно отчитане.
Интерактивен механизъм: как всъщност работи
Разгледайте интерактивно основната технология зад тази разработка.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Какво да гледате след това
Ключовите въпроси са дали планираният капацитет на GPU пристига по график, къде е разгърнат, до какво имат достъп клиентите и на каква цена и дали претенциите на компаниите за производителност и ефективност се поддържат при независима производствена употреба. Изданието не предоставя подробен график за внедряване, ангажименти на клиентите, изисквания за захранване или специфични федерални програми.
Първо, наблюдавайте изпълнението спрямо целта за 2027–2028 г. Източникът не разделя 2-те милиона графични процесора на годишни етапи, региони, сайтове за центрове за данни или конкретни количества продукти, освен назоваването на семействата Blackwell Ultra, Rubin и Rubin Ultra. Също така не се казва колко капацитет е поръчан, финансиран, инсталиран или запазен за клиенти. Производството, опаковането, работата в мрежа, наличността на захранване и промените в регулаторния или експортния контрол могат да повлияят на крайния мащаб, но изданието не предлага доказателства на ниво проект по тези въпроси.
Второ, проучете дали заявената ефективност и производителност се превръщат в реални натоварвания. AWS и NVIDIA отчитат до 3,7 пъти по-бърза обработка на данни и 30% по-добра ценова производителност за определени GPU-ускорени Amazon EMR конфигурации, както и до 9 пъти по-бързо векторно индексиране на една четвърт от цената на Amazon OpenSearch. Източникът не уточнява наборите от данни, базовите линии, формите на работното натоварване, нивата на използване или общите оперативни разходи. Необходими са независими тестове, за да се определи колко представителни са тези цифри за клиенти, работещи с генериране с разширено извличане, семантично търсене, широкомащабни анализи или други производствени приложения.
И накрая, вижте практическото внедряване на модела, сигурността и роботиката. Изданието казва, че моделите на Nemotron ще бъдат достъпни чрез Bedrock и SageMaker, но не дава нови имена на модели, дати на пускане, цени или регионална наличност. В него се казва, че Amazon Robotics и NVIDIA ще работят в симулация, генериране на синтетични данни, обучение на роботи, оптимизиране на маршрута, функционална безопасност и валидиране от реално към SIM, но не обявява конкретен робот, съоръжение, резултат от внедряване или оценка на безопасността. Най-важното неизвестно е дали тези интеграции произвеждат измерими ползи за клиентите и проверими предпазни мерки в мащаба, описан от компаниите.