Torna alle notizie
IndustriaAI Understanding briefing

TechCrunch: il vantaggio dell'intelligenza artificiale di Nvidia si sta espandendo oltre le GPU

TechCrunch riferisce che Nvidia compete sempre più attraverso CPU, reti, sistemi di archiviazione e orchestrazione che aiutano i grandi data center AI a spostare i dati in modo efficiente attorno alle GPU.

5 min readRead the original reporting
Source-provided image accompanying TechCrunch: Nvidia’s AI advantage is expanding beyond GPUs
Segnalazione attribuitaFonte registrata
Editore
techcrunch.com
Collegamento alla fonte
techcrunch.comhttps://techcrunch.com/2026/08/29/nvidias-ai-advantage-is-moving-beyond-the-gpu/
Tipo di fonte
Segnalazione da parte di un organo di stampa, non un documento di prima parte.

Ciò che non abbiamo potuto confermare in modo indipendente: Questa affermazione è attribuita al punto vendita indicato. Non lo abbiamo verificato rispetto a un documento di prima parte. (techcrunch.com)

ContestoComprendilo in 60 secondi

Inizia qui

Termini chiave

Memoria (memoria dell'agente)
Contesto archiviato che un agente AI utilizza attraverso passaggi o sessioni per migliorare la continuità.
Punto di riferimento
Un test o un set di dati standardizzato utilizzato per misurare e confrontare le prestazioni del modello.
Inferenza
La fase di runtime in cui un modello addestrato genera previsioni o output.
Mettiti alla provaQuiz sulla spiegazione dei modelli di intelligenza artificiale

Cosa è successo

TechCrunch riferisce che il vantaggio competitivo di Nvidia nell'infrastruttura AI si sta spostando oltre i suoi processori grafici. Man mano che i data center IA si avvicinano al consumo energetico a livello di gigawatt, l’azienda vende sistemi integrati destinati a coordinare memoria, archiviazione, rete ed elaborazione attorno alla GPU. Il rapporto si concentra sull'architettura Vera Rubin di Nvidia, che combina la GPU Rubin con la CPU Vera, gli acceleratori di inferenza Groq 3 LPX e i relativi rack di archiviazione e rete. Il dirigente di Nvidia Jason Hardy ha dichiarato a TechCrunch che la CPU Vera è progettata per aiutare a indirizzare i dati alla GPU al momento giusto. Hardy ha affermato che Nvidia ha riscontrato un miglioramento fino a tre volte in alcune operazioni, sebbene TechCrunch non abbia verificato in modo indipendente tale affermazione. TechCrunch confronta anche l'approccio di Nvidia con il chip Jalapeño di OpenAI, progettato per ridurre lo spostamento dei dati mantenendo un intero carico di lavoro all'interno di un unico sistema connesso. Gli approcci differiscono, ma entrambi affrontano lo stesso problema infrastrutturale: spostare i dati in modo efficiente può essere importante tanto quanto aggiungere capacità del processore.

TechCrunch riferisce che il recente vantaggio dell'intelligenza artificiale di Nvidia è sempre più legato all'infrastruttura che circonda la GPU. Il punto vendita afferma che l’informatica basata sull’intelligenza artificiale sta crescendo verso la scala dei gigawatt, rendendo più difficile gestire in modo efficiente grandi data center. In tale ambiente, sostiene l’articolo, il coordinamento del movimento dei dati e dei componenti del sistema diventa una sfida ingegneristica centrale piuttosto che una preoccupazione secondaria.

Il rapporto identifica l’architettura Vera Rubin di Nvidia come un esempio di questa strategia. Secondo TechCrunch, l'architettura abbina la GPU Rubin con la CPU Vera, acceleratori di inferenza Groq 3 LPX e rack comparabili per l'archiviazione e il networking. Il punto vendita descrive questi componenti come sistemi specializzati destinati a migliorare il funzionamento di tutto ciò che circonda la GPU, piuttosto che semplicemente elaborare i token stessi.

Jason Hardy, vicepresidente della tecnologia di archiviazione di Nvidia, ha dichiarato a TechCrunch che la CPU Vera affronta la capacità di memoria limitata di un singolo server o piattaforma di elaborazione e aiuta a orchestrare i dati. TechCrunch riporta che Hardy afferma che Nvidia ha osservato un miglioramento fino a tre volte in alcune operazioni e potrebbe utilizzare l'archiviazione flash in modo più completo senza creare colli di bottiglia. Questa affermazione sulle prestazioni proviene da Nvidia e non è stata confermata in modo indipendente nella fonte.

TechCrunch mette a confronto l'approccio a livello di sistema di Nvidia con il chip Jalapeño di OpenAI. Il punto vendita cita OpenAI che afferma che Jalapeño è stato progettato per ridurre al minimo il movimento dei dati e i ritardi di comunicazione mantenendo un intero carico di lavoro all'interno di un sistema connesso. Nvidia e OpenAI utilizzano design diversi, ma TechCrunch afferma che entrambi cercano l'efficienza attraverso un controllo più intelligente del movimento dei dati piuttosto che solo attraverso cicli aggiuntivi del processore.

Dettagli della fonte: techcrunch.com ↗

Perché è importante

Il rapporto descrive un cambiamento nel modo in cui l’infrastruttura AI può essere valutata. Le prestazioni della GPU rimangono importanti, ma i risultati pratici di un grande sistema di intelligenza artificiale possono dipendere anche dall’accesso alla memoria, dall’archiviazione, dalla rete e dal software e dall’hardware utilizzati per coordinare tali componenti. Ciò potrebbe rendere più difficile per i concorrenti sfidare Nvidia semplicemente offrendo un acceleratore alternativo. Un rivale dovrebbe eguagliare le prestazioni di un sistema più ampio, comprese le connessioni tra i chip e i meccanismi che mantengono i costosi processori riforniti di dati. Le implicazioni restano incerte. Il resoconto di TechCrunch si basa in parte sulla spiegazione dei suoi sistemi da parte di Nvidia e sulle dichiarazioni di prestazione di un dirigente. La fonte non fornisce risultati di indipendenti, prezzi, cifre di implementazione o prove che il vantaggio dell’intero sistema di Nvidia persisterà man mano che gli hyperscaler svilupperanno la propria infrastruttura.

Il rapporto è importante perché amplia la definizione di capacità di calcolo dell’IA. Un potente acceleratore può essere sottoutilizzato se i dati, i parametri del modello o i risultati intermedi non lo raggiungono abbastanza rapidamente. Il punto centrale dell’articolo è che la progettazione del sistema può determinare l’efficacia con cui vengono utilizzati i costosi processori IA.

Ciò crea una possibile barriera per gli sfidanti. TechCrunch riferisce che hyperscaler come Amazon e Google hanno sviluppato i propri chip, riducendo lo status di Nvidia come unico fornitore di GPU AI avanzate. Ma una GPU o un acceleratore alternativo potrebbe non essere sufficiente se non dispone di capacità di memoria, archiviazione, rete e orchestrazione comparabili.

Lo spostamento potrebbe incidere anche sulla spesa per le infrastrutture. Se lo spostamento e il coordinamento dei dati costituiscono vincoli importanti, gli acquirenti potrebbero dover valutare i rack completi e le architetture di sistema anziché confrontare solo le specifiche dell'acceleratore. Ciò potrebbe rafforzare la posizione dei fornitori in grado di fornire hardware e software strettamente integrati, aumentando potenzialmente la complessità e i costi del cambio di fornitore.

Le prove hanno limiti importanti. I rapporti di TechCrunch includono conversazioni con il personale Nvidia e dati sulle prestazioni forniti da un dirigente Nvidia, ma la fonte non fornisce test indipendenti, dati sull'implementazione dei clienti, prezzi, misurazioni della potenza o confronti con i sistemi concorrenti. Il rapporto supporta l’esistenza di una strategia di sistema più ampia di Nvidia, ma non dimostra che l’azienda manterrà un vantaggio duraturo.

Interactive Mechanism

Meccanismo interattivo: come funziona realmente

Esplora la tecnologia alla base di questo sviluppo in modo interattivo.

Document Size:128K tokens
Needle Placement Depth (Location in document):50% into text
Attention Context Buffer Map:
Target Fact (50%)
Equivalent Pages~320Standard book pages
Retrieval Accuracy99.9%Needle recall score
RAM / KV Cache5.1 GBMemory overhead
Prompt CachingActive~80% discount on reuse
Core takeaway: Million-token context windows allow querying whole codebases or legal archives in one prompt. However, KV cache memory scales with context length, making prompt caching crucial for real-time production.
Verifica concettuale interattiva+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Cosa guardare dopo

Controlla se Nvidia pubblica misurazioni indipendenti e riproducibili per il sistema Vera Rubin, tra cui throughput end-to-end, consumo energetico, prestazioni di memoria e archiviazione e le condizioni alla base del triplo miglioramento riportato. Guarda come rispondono Amazon, Google e altri grandi operatori cloud. TechCrunch riferisce che gli hyperscaler hanno sviluppato i propri chip, ma la concorrenza più conseguente potrebbe coinvolgere sistemi completi per il coordinamento di elaborazione, memoria, archiviazione e rete. Controlla anche se i clienti acquistano l'infrastruttura integrata di Nvidia come pacchetto o sostituiscono componenti di più fornitori. Il rapporto suggerisce che l’orchestrazione sta diventando un importante livello competitivo, ma non stabilisce quanto ampiamente siano disponibili i sistemi Nvidia, quanto costano o come si comportano in produzione.

La prossima prova più utile sarebbe un test trasparente e condotto da terzi sui sistemi Vera Rubin. Tali test dovrebbero separare le prestazioni della GPU dai guadagni attribuibili alla CPU Vera, allo storage flash, alla rete e all'orchestrazione, e dovrebbero spiegare i carichi di lavoro e la linea di base utilizzata per qualsiasi miglioramento dichiarato.

Anche la disponibilità e i termini di acquisto avranno importanza. La fonte descrive l'architettura di Nvidia e l'attuale lancio, ma non dice quali clienti possono ottenere i sistemi, in quali quantità, a quale prezzo o se i singoli componenti possono essere combinati con hardware di altri fornitori. Questi dettagli determineranno se la strategia è sostanzialmente pratica o principalmente un’offerta Nvidia integrata.

Le risposte dei concorrenti mostreranno se il mercato si sta muovendo verso una competizione a livello di sistema. I fornitori di servizi cloud potrebbero progettare architetture alternative attorno ai propri chip, mentre altri produttori di chip potrebbero concentrarsi su memoria, rete, storage o interconnessioni piuttosto che competere direttamente sulle prestazioni della GPU. La fonte non identifica specifici sistemi rivali né fornisce prove sulle loro attuali capacità.

Il design Jalapeño di OpenAI è un utile paragone, ma non dovrebbe essere trattato come una prova che un approccio sia superiore. La dichiarazione di OpenAI, citata da TechCrunch, descrive uno sforzo per ridurre il movimento dei dati all'interno di un chip connesso. Sono necessarie ulteriori informazioni per confrontare tale progetto con il modello di orchestrazione distribuita di Nvidia in termini di carichi di lavoro reali, consumo di energia, affidabilità e costi operativi totali.

Guide e quiz correlati

Spiegazione dei modelli di intelligenza artificialeTrasformatoriFormazione sull'intelligenza artificialeFuturo dell'IAMetti alla prova ciò che sai: prova un quiz gratuito sull'intelligenza artificialeCerca un termine AI nel nostro glossarioSegui il tracker dei finanziamenti AI
Lo hai trovato utile?