Nini kilitokea
AWS na NVIDIA zilitangaza ushirikiano uliopanuliwa wa kimkakati unaozingatia kuongeza uwezo wa kompyuta wa AI na kuunganisha zaidi maunzi na programu ya NVIDIA na huduma za AWS. Kampuni hizo zinasema AWS inapanga kupeleka NVIDIA Blackwell Ultra, Rubin na Rubin Ultra GPU zaidi ya milioni 2 katika miundombinu yake ya kimataifa mwaka wa 2027 na 2028, ikiwa ni pamoja na viwanda vya AI na uwezo wa AI ya mawakala, ugunduzi wa kisayansi, automatisering ya biashara na mizigo ya kimwili ya AI.
AWS na NVIDIA walisema wanapanua ushirikiano wa miaka 16 ili kukidhi kile wanachoeleza kuwa ni kuharakisha mahitaji ya miundombinu ya AI. Ahadi kuu ni mpango wa AWS kupeleka GPU milioni 2 za ziada za NVIDIA katika miundombinu yake ya kimataifa wakati wa 2027 na 2028. Mifumo iliyopangwa ni pamoja na NVIDIA Blackwell Ultra, Rubin na Rubin Ultra GPU, zenye uwezo unaokusudiwa kwa ajili ya mzigo wa kazi unaohusisha mawakala wa AI, ugunduzi wa kisayansi na enterprise. Kwa sababu tangazo linatumia lugha ya wakati ujao, linafafanua utumaji uliopangwa badala ya usakinishaji uliokamilika au orodha inayopatikana kwa sasa.
Kampuni hizo pia zilisema AWS itapanua uwezo wake wa NVIDIA Blackwell, ikijumuisha GPU za RTX PRO 4500 Blackwell Server Edition kwa matukio ya Amazon EC2 G7. NVIDIA na AWS zinasema kuwa matukio ya G7 hutoa mara 4.6 ya utendaji wa makisio ya AI na mara 2.1 ya utendaji wa picha wa matukio ya G6 ya kizazi cha awali. Hayo ni madai katika kutolewa kwa makampuni; chanzo hakitambui hali za majaribio, mzigo wa kazi, bei au uthibitishaji huru nyuma ya ulinganisho. AWS inaelezewa kama mtoaji mkuu wa kwanza wa wingu kutoa hali zilizoharakishwa na RTX PRO 4500, kulingana na toleo.
Ushirikiano mpana unashughulikia tabaka kadhaa za safu ya AI. AWS na NVIDIA walisema wanafanya kazi kuleta miundombinu ya NVIDIA Vera CPU kwa AWS, kupanua NVLink Fusion na teknolojia ya kumbukumbu ya kiwango cha juu cha NVIDIA kwa ushirikiano na wasambazaji wa kumbukumbu, na kuunganisha jukwaa la ZXQAIUsU0QZX na Mfumo wa ZXQAIU0U0QZX Adapta ya Kitambaa cha Elastic. Pia wanapanga kuendelea kutoa mifano ya wazi ya NVIDIA Nemotron kupitia Amazon Bedrock na Amazon SageMaker, kuharakisha usindikaji wa data na uwekaji faharasa wa vekta kupitia NVIDIA CUDA-X maktaba kwenye Amazon EMR na ZXZQAIU1 kazi ya roboti kupitia OpenSeiU1 Matumizi ya Roboti ya NVIDIA ya jukwaa halisi la AI la NVIDIA.
Maelezo ya chanzo: nvidianews.nvidia.com ↗
Kwa nini ni muhimu
Tangazo hilo lingepanua miundombinu ya wingu inayopatikana kwa ukuzaji na usambazaji wa AI kwa kiwango kikubwa, lakini kimsingi ni mpango wa kutazama mbele badala ya ushahidi kwamba uwezo tayari umewasilishwa. Pia inaunganisha miundombinu ya AI na mzigo wa kazi wa serikali, usindikaji wa data ya biashara na robotiki, kupanua ushirikiano zaidi ya matukio ya GPU pekee.
Ikitolewa, uwezo wa ziada unaweza kuathiri jinsi mashirika yanavyohamisha miradi ya AI kutoka kwa majaribio hadi uzalishaji. Toleo hili huangazia upanuzi wa mifumo ya mawakala, ambayo inaweza kuhitaji simu za modeli zinazorudiwa na muundo msingi wa data, na AI halisi, ambayo inaweza kuhitaji uigaji, mafunzo na uthibitishaji wa mizigo ya kazi. Pia inaangazia matumizi ya kisayansi na biashara, ikipendekeza kwamba hadhira inayokusudiwa ienee zaidi ya idadi ndogo ya maabara za mipakani. Chanzo hakitambui ni kiasi gani cha uwezo uliopangwa kitapatikana kwa wateja wa kawaida wa wingu au jinsi ufikiaji utatengwa.
Tangazo ni muhimu kwa sababu linachanganya usambazaji wa maunzi, utumiaji wa wingu na ujumuishaji wa programu katika mpangilio mmoja wa kibiashara. Wateja wa AWS, kimsingi, wangeweza kutumia NVIDIA GPU pamoja na silikoni maalum ya AWS na NVIDIA Vera CPU, huku NVLink Fusion ikiweza kuunganisha NVIDIA na vijenzi vya Trainium ndani ya usanifu wa kawaida wa kiwango cha rack. Kampuni zinaelezea hii kama njia ya kusaidia miundombinu ya AI isiyo ya kawaida. Hilo linaweza kuwapa wasanidi chaguo zaidi chaguo za kulinganisha mizigo tofauti ya kazi na vichakataji tofauti, lakini chanzo hakitoi alama zinazojitegemea kulinganisha usanidi mseto na mbadala au kueleza kikomo cha uhandisi cha kusogeza mizigo ya kazi kati yao.
Kitengo cha serikali kinaongeza viwango vya maslahi ya umma. AWS na NVIDIA walisema wanapanga kujenga viwanda vya AI kwa ajili ya serikali ya Marekani, ikijumuisha GPU 100,000 kwenye miundombinu salama ya AWS kwa ajili ya mzigo wa kazi wa shirikisho na usalama wa kitaifa katika Kiwango cha 6 cha Athari na zaidi. Toleo hili halitaji mawakala, programu, tovuti za utumaji, bajeti, kalenda ya matukio au kazi mahususi ambazo mifumo hii ingefanya. Kwa hivyo inaweka ahadi iliyobainishwa ya miundombinu, sio ushahidi wa uwekaji mahususi wa usalama wa kitaifa au tathmini ya matokeo yake. Matumizi yaliyopangwa pia hufanya usalama, uangalizi wa ununuzi na utunzaji wa mizigo nyeti kuwa maeneo muhimu kwa ripoti zaidi.
Mbinu shirikishi: Jinsi Inavyofanya Kazi Kweli
Chunguza teknolojia msingi nyuma ya ukuzaji huu kwa maingiliano.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Nini cha kutazama baadaye
Maswali muhimu ni ikiwa uwezo wa GPU uliopangwa unafika kwa ratiba, mahali inapotumwa, wateja wanaweza kufikia nini na kwa gharama gani, na kama madai ya utendaji na ufanisi wa makampuni yanashikilia katika matumizi huru ya uzalishaji. Toleo hili halitoi ratiba ya kina ya utekelezaji, ahadi za wateja, mahitaji ya nguvu au mipango mahususi ya shirikisho.
Kwanza, tazama utekelezaji dhidi ya lengo la 2027–2028. Chanzo hakivunji GPU milioni 2 katika matukio muhimu ya kila mwaka, maeneo, tovuti za kituo cha data au idadi mahususi ya bidhaa zaidi ya kutaja familia za Blackwell Ultra, Rubin na Rubin Ultra. Pia haisemi ni kiasi gani cha uwezo ambacho kimeagizwa, kufadhiliwa, kusakinishwa au kuhifadhiwa kwa ajili ya wateja. Utengenezaji, upakiaji, mitandao, upatikanaji wa nishati na mabadiliko ya udhibiti au udhibiti wa mauzo ya nje yanaweza kuathiri kiwango cha mwisho, lakini toleo halitoi ushahidi wa kiwango cha mradi kuhusu masuala hayo.
Pili, chunguza ikiwa ufanisi unaodaiwa na utendakazi hutafsiri kuwa mzigo halisi wa kazi. AWS na NVIDIA zinaripoti hadi mara 3.7 uchakataji wa haraka wa data na utendakazi bora wa bei 30% kwa usanidi fulani wa Amazon EMR unaoharakishwa na GPU, pamoja na uwekaji faharasa wa vekta hadi mara 9 kwa robo moja ya gharama kwenye Amazon OpenSearch. Chanzo hakibainishi seti za data, misingi, maumbo ya mzigo wa kazi, viwango vya matumizi au jumla ya gharama za uendeshaji. Jaribio la kujitegemea litahitajika ili kubaini jinsi takwimu hizo zinavyowakilisha wateja wanaoendesha kizazi kilichoboreshwa, utafutaji wa kimaana, uchanganuzi wa kiwango kikubwa au programu zingine za uzalishaji.
Hatimaye, tazama uchapishaji wa vitendo wa modeli, usalama na vipande vya roboti. Toleo hilo linasema miundo ya Nemotron itapatikana kupitia Bedrock na SageMaker, lakini haitoi majina ya modeli mpya, tarehe za kutolewa, bei au upatikanaji wa kikanda. Inasema Amazon Robotiki na NVIDIA zitafanya kazi katika uigaji, uundaji wa data sanisi, mafunzo ya roboti, uboreshaji wa njia, usalama wa utendaji kazi na uthibitishaji halisi wa sim, lakini haitangazi roboti mahususi, kituo, matokeo ya kupelekwa au tathmini ya usalama. Jambo muhimu zaidi lisilojulikana ni ikiwa miunganisho hii inazalisha manufaa ya wateja yanayoweza kupimika na ulinzi unaoweza kuthibitishwa kwa kiwango ambacho makampuni yanaelezea.