Apa yang berlaku
AWS dan NVIDIA mengumumkan kerjasama strategik yang diperluaskan yang tertumpu pada peningkatan kapasiti pengkomputeran AI dan menyepadukan lebih banyak perkakasan dan perisian NVIDIA dengan perkhidmatan AWS. Syarikat itu berkata AWS merancang untuk menggunakan 2 juta tambahan NVIDIA Blackwell Ultra, Rubin dan Rubin Ultra GPU merentasi infrastruktur globalnya pada 2027 dan 2028, termasuk kilang AI dan kapasiti untuk AI agen, penemuan saintifik, automasi perusahaan dan beban kerja AI fizikal.
AWS dan NVIDIA berkata mereka mengembangkan kerjasama 16 tahun untuk memenuhi apa yang mereka sifatkan sebagai mempercepatkan permintaan untuk infrastruktur AI. Komitmen utama ialah rancangan untuk AWS menggunakan 2 juta GPU NVIDIA tambahan merentasi infrastruktur globalnya sepanjang 2027 dan 2028. Sistem yang dirancang termasuk NVIDIA Blackwell Ultra, Rubin dan GPU Rubin Ultra, dengan kapasiti yang ditujukan untuk beban kerja yang melibatkan ejen AI, automasi fizikal, AI perusahaan. Oleh kerana pengumuman menggunakan bahasa masa hadapan, ia menerangkan penggunaan yang dirancang dan bukannya pemasangan yang lengkap atau inventori yang tersedia pada masa ini.
Syarikat itu juga berkata AWS akan mengembangkan kapasiti NVIDIA Blackwellnya, termasuk GPU RTX PRO 4500 Blackwell Edisi Pelayan untuk kejadian Amazon EC2 G7. NVIDIA dan AWS menyatakan bahawa tika G7 memberikan 4.6 kali ganda prestasi inferens AI dan 2.1 kali ganda prestasi grafik bagi tika G6 generasi sebelumnya. Itu adalah tuntutan dalam pelepasan syarikat; sumber tidak mengenal pasti keadaan ujian, beban kerja, harga atau pengesahan bebas di sebalik perbandingan. AWS digambarkan sebagai penyedia awan utama pertama yang menawarkan contoh yang dipercepatkan oleh RTX PRO 4500, menurut keluaran itu.
Kerjasama yang lebih luas meliputi beberapa lapisan timbunan AI. AWS dan NVIDIA berkata mereka sedang berusaha untuk membawa infrastruktur berasaskan CPU NVIDIA Vera kepada AWS, melanjutkan NVLink Fusion dengan teknologi memori lebar jalur tinggi tersuai NVIDIA dengan kerjasama pembekal memori, dan menyepadukan platform NVIDIA NVIDIA ZXQlastics dengan System Penyesuai Fabrik. Mereka juga bercadang untuk terus menawarkan model terbuka NVIDIA Nemotron melalui Amazon Bedrock dan Amazon SageMaker, mempercepatkan pemprosesan data dan pengindeksan vektor melalui perpustakaan NVIDIA CUDA-X pada Amazon EMR dan ZXZAIU1 kerja, dan memajukan robot OpenSearch1. Amazon Robotik menggunakan platform AI fizikal NVIDIA.
Butiran sumber: nvidianews.nvidia.com ↗
Mengapa ia penting
Pengumuman itu akan mengembangkan infrastruktur awan yang tersedia untuk pembangunan dan penggunaan AI berskala besar, tetapi ia adalah pelan yang berpandangan ke hadapan dan bukannya bukti bahawa kapasiti itu telah pun disampaikan. Ia juga menghubungkan infrastruktur AI kepada beban kerja kerajaan, pemprosesan data perusahaan dan robotik, memperluaskan perkongsian melangkaui kejadian GPU sahaja.
Jika dihantar, kapasiti tambahan boleh menjejaskan seberapa cepat organisasi memindahkan projek AI daripada percubaan kepada pengeluaran. Keluaran ini secara khusus merangka pengembangan sekitar sistem agen, yang mungkin memerlukan panggilan model berulang dan infrastruktur data sokongan, dan AI fizikal, yang boleh memerlukan simulasi, latihan dan beban kerja pengesahan. Ia juga menunjukkan penggunaan saintifik dan perusahaan, menunjukkan bahawa khalayak yang dimaksudkan melangkaui sebilangan kecil makmal sempadan. Sumber itu tidak menentukan berapa banyak kapasiti yang dirancang akan tersedia kepada pelanggan awan biasa atau cara akses akan diperuntukkan.
Pengumuman itu penting kerana ia menggabungkan bekalan perkakasan, penggunaan awan dan penyepaduan perisian dalam satu susunan komersial. Pelanggan AWS, pada dasarnya, boleh menggunakan GPU NVIDIA bersama silikon tersuai AWS dan CPU NVIDIA Vera, manakala NVLink Fusion boleh menyambungkan komponen NVIDIA dan Trainium dalam seni bina skala rak biasa. Syarikat-syarikat menggambarkan ini sebagai cara untuk menyokong infrastruktur AI yang heterogen. Itu mungkin memberi pembangun lebih banyak pilihan untuk memadankan beban kerja yang berbeza kepada pemproses yang berbeza, tetapi sumbernya tidak menyediakan penanda aras bebas yang membandingkan konfigurasi bercampur dengan alternatif atau menerangkan had kejuruteraan untuk memindahkan beban kerja antara mereka.
Komponen kerajaan meningkatkan kepentingan kepentingan awam. AWS dan NVIDIA berkata mereka merancang untuk membina kilang AI untuk kerajaan A.S., termasuk 100,000 GPU pada infrastruktur AWS selamat untuk beban kerja keselamatan persekutuan dan negara di Tahap Impak 6 dan ke atas. Keluaran itu tidak menamakan agensi, program, tapak penempatan, belanjawan, garis masa atau tugas khusus yang akan dilaksanakan oleh sistem ini. Oleh itu, ia menetapkan komitmen infrastruktur yang dinyatakan, bukan bukti penempatan keselamatan negara tertentu atau penilaian akibatnya. Penggunaan yang dirancang juga menjadikan keselamatan, pengawasan perolehan dan pengendalian beban kerja yang sensitif menjadi bidang penting untuk pelaporan selanjutnya.
Mekanisme Interaktif: Bagaimana Ia Berfungsi Sebenarnya
Terokai teknologi asas di sebalik pembangunan ini secara interaktif.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Apa yang perlu ditonton seterusnya
Soalan utama ialah sama ada kapasiti GPU yang dirancang tiba mengikut jadual, di mana ia digunakan, apa yang boleh diakses oleh pelanggan dan berapa kosnya, dan sama ada tuntutan prestasi dan kecekapan syarikat berlaku dalam penggunaan pengeluaran bebas. Keluaran tidak menyediakan jadual pelaksanaan terperinci, komitmen pelanggan, keperluan kuasa atau program persekutuan tertentu.
Pertama, lihat pelaksanaan terhadap sasaran 2027–2028. Sumber itu tidak memecahkan 2 juta GPU kepada pencapaian tahunan, wilayah, tapak pusat data atau kuantiti produk tertentu selain menamakan keluarga Blackwell Ultra, Rubin dan Rubin Ultra. Ia juga tidak menyatakan berapa banyak kapasiti yang telah dipesan, dibiayai, dipasang atau dikhaskan untuk pelanggan. Pembuatan, pembungkusan, rangkaian, ketersediaan kuasa dan perubahan peraturan atau kawalan eksport boleh menjejaskan skala akhir, tetapi keluaran itu tidak menawarkan bukti peringkat projek mengenai isu tersebut.
Kedua, periksa sama ada kecekapan dan prestasi yang didakwa diterjemahkan ke dalam beban kerja sebenar. AWS dan NVIDIA melaporkan pemprosesan data sehingga 3.7 kali lebih pantas dan prestasi harga 30% lebih baik untuk konfigurasi EMR Amazon yang dipercepatkan GPU tertentu, serta pengindeksan vektor sehingga 9 kali lebih pantas pada satu perempat daripada kos Amazon OpenSearch. Sumber tidak menyatakan set data, garis dasar, bentuk beban kerja, kadar penggunaan atau jumlah kos operasi. Ujian bebas diperlukan untuk menentukan keterwakilan angka tersebut untuk pelanggan yang menjalankan penjanaan ditambah perolehan, carian semantik, analitik berskala besar atau aplikasi pengeluaran lain.
Akhir sekali, tonton pelancaran praktikal model, keselamatan dan bahagian robotik. Keluaran mengatakan model Nemotron akan tersedia melalui Bedrock dan SageMaker, tetapi ia tidak memberikan nama model baharu, tarikh keluaran, harga atau ketersediaan serantau. Ia mengatakan Robotik Amazon dan NVIDIA akan berfungsi merentasi simulasi, penjanaan data sintetik, latihan robot, pengoptimuman laluan, keselamatan berfungsi dan pengesahan sebenar-ke-sim, tetapi tidak mengumumkan robot, kemudahan, hasil penggunaan atau penilaian keselamatan tertentu. Perkara yang paling penting tidak diketahui ialah sama ada penyepaduan ini menghasilkan faedah pelanggan yang boleh diukur dan perlindungan yang boleh disahkan pada skala yang diterangkan oleh syarikat.