Rudi kwa Habari
ViwandaAI Understanding muhtasari

AWS na NVIDIA wanapanga GPU milioni 2 zaidi kwa AI ya kiajenti na kimwili.

AWS na NVIDIA wanasema wanapanga kupeleka NVIDIA GPU zaidi ya milioni 2 kwenye miundombinu ya AWS mnamo 2027 na 2028 huku wakipanua ushirikiano kwenye CPU, mitandao, miundo wazi, usindikaji wa data na roboti.

5 min readRead the primary source
Primary-source image accompanying AWS and NVIDIA plan 2 million more GPUs for agentic and physical AI
Hati ya chanzo msingiChanzo kimerekodiwa
Mchapishaji
nvidianews.nvidia.com
Kiungo cha chanzo
nvidianews.nvidia.comhttps://nvidianews.nvidia.com/news/aws-and-nvidia-to-deliver-2-million-additional-gpus-and-next-generation-infrastructure-for-agentic-and-physical-ai
Aina ya chanzo
Hati ya msingi - tangazo rasmi, karatasi, faili, au ukurasa wa mtu wa kwanza tunasoma moja kwa moja.
MuktadhaElewa hili katika sekunde 60

Anzia hapa

Masharti muhimu

RAG (Kizazi Kilichoongezwa cha Urejeshaji)
Njia ambayo hurejesha maarifa ya nje na kuyalisha katika kizazi kwa wakati wa makisio.
Kumbukumbu (Kumbukumbu ya Wakala)
Muktadha uliohifadhiwa wakala wa AI hutumia katika hatua au vipindi ili kuboresha mwendelezo.
Utafutaji wa Semantiki
Tafuta unaolingana na maana badala ya mwingiliano halisi wa nenomsingi, mara nyingi kwa kutumia upachikaji.
Jijaribu mwenyeweMaswali ya Mawakala wa AI

Nini kilitokea

AWS na NVIDIA zilitangaza ushirikiano uliopanuliwa wa kimkakati unaozingatia kuongeza uwezo wa kompyuta wa AI na kuunganisha zaidi maunzi na programu ya NVIDIA na huduma za AWS. Kampuni hizo zinasema AWS inapanga kupeleka NVIDIA Blackwell Ultra, Rubin na Rubin Ultra GPU zaidi ya milioni 2 katika miundombinu yake ya kimataifa mwaka wa 2027 na 2028, ikiwa ni pamoja na viwanda vya AI na uwezo wa AI ya mawakala, ugunduzi wa kisayansi, automatisering ya biashara na mizigo ya kimwili ya AI.

AWS na NVIDIA walisema wanapanua ushirikiano wa miaka 16 ili kukidhi kile wanachoeleza kuwa ni kuharakisha mahitaji ya miundombinu ya AI. Ahadi kuu ni mpango wa AWS kupeleka GPU milioni 2 za ziada za NVIDIA katika miundombinu yake ya kimataifa wakati wa 2027 na 2028. Mifumo iliyopangwa ni pamoja na NVIDIA Blackwell Ultra, Rubin na Rubin Ultra GPU, zenye uwezo unaokusudiwa kwa ajili ya mzigo wa kazi unaohusisha mawakala wa AI, ugunduzi wa kisayansi na enterprise. Kwa sababu tangazo linatumia lugha ya wakati ujao, linafafanua utumaji uliopangwa badala ya usakinishaji uliokamilika au orodha inayopatikana kwa sasa.

Kampuni hizo pia zilisema AWS itapanua uwezo wake wa NVIDIA Blackwell, ikijumuisha GPU za RTX PRO 4500 Blackwell Server Edition kwa matukio ya Amazon EC2 G7. NVIDIA na AWS zinasema kuwa matukio ya G7 hutoa mara 4.6 ya utendaji wa makisio ya AI na mara 2.1 ya utendaji wa picha wa matukio ya G6 ya kizazi cha awali. Hayo ni madai katika kutolewa kwa makampuni; chanzo hakitambui hali za majaribio, mzigo wa kazi, bei au uthibitishaji huru nyuma ya ulinganisho. AWS inaelezewa kama mtoaji mkuu wa kwanza wa wingu kutoa hali zilizoharakishwa na RTX PRO 4500, kulingana na toleo.

Ushirikiano mpana unashughulikia tabaka kadhaa za safu ya AI. AWS na NVIDIA walisema wanafanya kazi kuleta miundombinu ya NVIDIA Vera CPU kwa AWS, kupanua NVLink Fusion na teknolojia ya kumbukumbu ya kiwango cha juu cha NVIDIA kwa ushirikiano na wasambazaji wa kumbukumbu, na kuunganisha jukwaa la ZXQAIUsU0QZX na Mfumo wa ZXQAIU0U0QZX Adapta ya Kitambaa cha Elastic. Pia wanapanga kuendelea kutoa mifano ya wazi ya NVIDIA Nemotron kupitia Amazon Bedrock na Amazon SageMaker, kuharakisha usindikaji wa data na uwekaji faharasa wa vekta kupitia NVIDIA CUDA-X maktaba kwenye Amazon EMR na ZXZQAIU1 kazi ya roboti kupitia OpenSeiU1 Matumizi ya Roboti ya NVIDIA ya jukwaa halisi la AI la NVIDIA.

Maelezo ya chanzo: nvidianews.nvidia.com ↗

Kwa nini ni muhimu

Tangazo hilo lingepanua miundombinu ya wingu inayopatikana kwa ukuzaji na usambazaji wa AI kwa kiwango kikubwa, lakini kimsingi ni mpango wa kutazama mbele badala ya ushahidi kwamba uwezo tayari umewasilishwa. Pia inaunganisha miundombinu ya AI na mzigo wa kazi wa serikali, usindikaji wa data ya biashara na robotiki, kupanua ushirikiano zaidi ya matukio ya GPU pekee.

Ikitolewa, uwezo wa ziada unaweza kuathiri jinsi mashirika yanavyohamisha miradi ya AI kutoka kwa majaribio hadi uzalishaji. Toleo hili huangazia upanuzi wa mifumo ya mawakala, ambayo inaweza kuhitaji simu za modeli zinazorudiwa na muundo msingi wa data, na AI halisi, ambayo inaweza kuhitaji uigaji, mafunzo na uthibitishaji wa mizigo ya kazi. Pia inaangazia matumizi ya kisayansi na biashara, ikipendekeza kwamba hadhira inayokusudiwa ienee zaidi ya idadi ndogo ya maabara za mipakani. Chanzo hakitambui ni kiasi gani cha uwezo uliopangwa kitapatikana kwa wateja wa kawaida wa wingu au jinsi ufikiaji utatengwa.

Tangazo ni muhimu kwa sababu linachanganya usambazaji wa maunzi, utumiaji wa wingu na ujumuishaji wa programu katika mpangilio mmoja wa kibiashara. Wateja wa AWS, kimsingi, wangeweza kutumia NVIDIA GPU pamoja na silikoni maalum ya AWS na NVIDIA Vera CPU, huku NVLink Fusion ikiweza kuunganisha NVIDIA na vijenzi vya Trainium ndani ya usanifu wa kawaida wa kiwango cha rack. Kampuni zinaelezea hii kama njia ya kusaidia miundombinu ya AI isiyo ya kawaida. Hilo linaweza kuwapa wasanidi chaguo zaidi chaguo za kulinganisha mizigo tofauti ya kazi na vichakataji tofauti, lakini chanzo hakitoi alama zinazojitegemea kulinganisha usanidi mseto na mbadala au kueleza kikomo cha uhandisi cha kusogeza mizigo ya kazi kati yao.

Kitengo cha serikali kinaongeza viwango vya maslahi ya umma. AWS na NVIDIA walisema wanapanga kujenga viwanda vya AI kwa ajili ya serikali ya Marekani, ikijumuisha GPU 100,000 kwenye miundombinu salama ya AWS kwa ajili ya mzigo wa kazi wa shirikisho na usalama wa kitaifa katika Kiwango cha 6 cha Athari na zaidi. Toleo hili halitaji mawakala, programu, tovuti za utumaji, bajeti, kalenda ya matukio au kazi mahususi ambazo mifumo hii ingefanya. Kwa hivyo inaweka ahadi iliyobainishwa ya miundombinu, sio ushahidi wa uwekaji mahususi wa usalama wa kitaifa au tathmini ya matokeo yake. Matumizi yaliyopangwa pia hufanya usalama, uangalizi wa ununuzi na utunzaji wa mizigo nyeti kuwa maeneo muhimu kwa ripoti zaidi.

Interactive Mechanism

Mbinu shirikishi: Jinsi Inavyofanya Kazi Kweli

Chunguza teknolojia msingi nyuma ya ukuzaji huu kwa maingiliano.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Ukaguzi wa Dhana ya Kuingiliana+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Nini cha kutazama baadaye

Maswali muhimu ni ikiwa uwezo wa GPU uliopangwa unafika kwa ratiba, mahali inapotumwa, wateja wanaweza kufikia nini na kwa gharama gani, na kama madai ya utendaji na ufanisi wa makampuni yanashikilia katika matumizi huru ya uzalishaji. Toleo hili halitoi ratiba ya kina ya utekelezaji, ahadi za wateja, mahitaji ya nguvu au mipango mahususi ya shirikisho.

Kwanza, tazama utekelezaji dhidi ya lengo la 2027–2028. Chanzo hakivunji GPU milioni 2 katika matukio muhimu ya kila mwaka, maeneo, tovuti za kituo cha data au idadi mahususi ya bidhaa zaidi ya kutaja familia za Blackwell Ultra, Rubin na Rubin Ultra. Pia haisemi ni kiasi gani cha uwezo ambacho kimeagizwa, kufadhiliwa, kusakinishwa au kuhifadhiwa kwa ajili ya wateja. Utengenezaji, upakiaji, mitandao, upatikanaji wa nishati na mabadiliko ya udhibiti au udhibiti wa mauzo ya nje yanaweza kuathiri kiwango cha mwisho, lakini toleo halitoi ushahidi wa kiwango cha mradi kuhusu masuala hayo.

Pili, chunguza ikiwa ufanisi unaodaiwa na utendakazi hutafsiri kuwa mzigo halisi wa kazi. AWS na NVIDIA zinaripoti hadi mara 3.7 uchakataji wa haraka wa data na utendakazi bora wa bei 30% kwa usanidi fulani wa Amazon EMR unaoharakishwa na GPU, pamoja na uwekaji faharasa wa vekta hadi mara 9 kwa robo moja ya gharama kwenye Amazon OpenSearch. Chanzo hakibainishi seti za data, misingi, maumbo ya mzigo wa kazi, viwango vya matumizi au jumla ya gharama za uendeshaji. Jaribio la kujitegemea litahitajika ili kubaini jinsi takwimu hizo zinavyowakilisha wateja wanaoendesha kizazi kilichoboreshwa, utafutaji wa kimaana, uchanganuzi wa kiwango kikubwa au programu zingine za uzalishaji.

Hatimaye, tazama uchapishaji wa vitendo wa modeli, usalama na vipande vya roboti. Toleo hilo linasema miundo ya Nemotron itapatikana kupitia Bedrock na SageMaker, lakini haitoi majina ya modeli mpya, tarehe za kutolewa, bei au upatikanaji wa kikanda. Inasema Amazon Robotiki na NVIDIA zitafanya kazi katika uigaji, uundaji wa data sanisi, mafunzo ya roboti, uboreshaji wa njia, usalama wa utendaji kazi na uthibitishaji halisi wa sim, lakini haitangazi roboti mahususi, kituo, matokeo ya kupelekwa au tathmini ya usalama. Jambo muhimu zaidi lisilojulikana ni ikiwa miunganisho hii inazalisha manufaa ya wateja yanayoweza kupimika na ulinzi unaoweza kuthibitishwa kwa kiwango ambacho makampuni yanaelezea.

Miongozo & maswali yanayohusiana

Mawakala wa AIMifano ya AI ImefafanuliwaMafunzo ya AIMustakabali wa AIJaribu unachojua - jaribu maswali ya AI bila malipoTafuta istilahi ya AI katika faharasa yetuFuata kifuatilia ufadhili cha AI
Je, umepata hii kuwa muhimu?