Riassunto:
Nvidia prevede di investire in d‑Matrix, secondo tre persone a conoscenza dell'accordo. Questa azienda fondata 7 anni fa si concentra sulla ricerca e sullo sviluppo di chip per server per l'intelligenza artificiale e il suo obiettivo di prodotto è competere con Nvidia. Questa proposta di investimento è un'iniziativa di Nvidia per promuovere la compatibilità della propria tecnologia con i progettisti di chip concorrenti e portare i concorrenti nel suo ecosistema hardware dominante, anche se la quota di Nvidia nel mercato dei chip di inferenza AI continua a crescere.

Questo è anche il primo accordo di Nvidia con una startup di chip di inferenza AI da quando ha firmato un accordo di licenza tecnologica da 20 miliardi di dollari con Groq nel dicembre dello scorso anno. Ciò dimostra che Nvidia non intende scommettere solo su questa azienda.
Tre mesi fa, Nvidia ha lanciato un modello di cooperazione con i suoi concorrenti nel campo dei chip, consentendo ai chip delle due società di lavorare insieme e condividere compiti diversi nello stesso insieme di carichi di lavoro di inferenza AI. L'obiettivo è migliorare l'efficienza operativa di tali attività informatiche.
È difficile per i concorrenti scuotere l'enorme vantaggio di Nvidia, quindi sempre più produttori scelgono di lavorare con le GPU Nvidia invece di sostituirle completamente. NVIDIA incoraggia i concorrenti a connettersi al proprio ecosistema e può anche avvantaggiare i suoi prodotti hardware di rete; questi prodotti possono interconnettere più gruppi di rack di server come un sistema complessivo per completare calcoli AI ad alto carico. Questa soluzione tecnica è il calcolo parallelo.

Negli ultimi 12 mesi, Nvidia ha completato investimenti multimiliardari in Intel e Broadcom, altri due grandi concorrenti di chip AI, in parte per promuovere l'integrazione delle GPU Nvidia con questi due chip aziendali. Non è chiaro quando tali integrazioni saranno disponibili su larga scala. Persone provenienti da diverse start-up di chip hanno rivelato che Nvidia ha anche promosso soluzioni a diverse altre start-up di chip, sperando che i loro chip possano essere compatibili con le GPU dotate della tecnologia di rete Nvidia.
Nell'agosto di quest'anno, anche Amazon ha proposto un'idea di integrazione simile: lasciare che la GPU Nvidia e il chip AI Trainium sviluppato da Amazon coesistano e funzionino simultaneamente nello stesso data center utilizzando un server rack con un'architettura unificata; allo stesso tempo, il chip Trainium può anche chiamare la rete e l'hardware di memoria di Nvidia.
Anche SambaNova Systems, un'altra startup di chip, ha presentato a giugno una soluzione per interconnettere i propri chip con le GPU NVIDIA per eseguire insieme modelli di intelligenza artificiale. Oltre a promuovere l'integrazione eterogenea sopra menzionata, NVIDIA sta anche sviluppando in modo indipendente un sistema di chip che combina la GPU con il chip di inferenza AI dedicato di Groq. In precedenza, NVIDIA aveva assorbito anche il team fondatore di Groq e molti dipendenti attraverso questa transazione di licenza tecnologica da 20 miliardi di dollari.
Secondo fonti vicine all'indagine, il Dipartimento di Giustizia degli Stati Uniti sta esaminando se Nvidia abbia progettato l'accordo con Groq in modo da eludere un'indagine formale del Dipartimento di Giustizia sull'impatto dell'accordo sul mercato dei chip. La notizia è stata riportata per la prima volta dal New York Times.
Chiamare chip di diversi produttori per elaborare congiuntamente la stessa attività di intelligenza artificiale è un concetto di settore abbastanza nuovo, chiamato
inferenza disaggregata
Neurone AWS. Sebbene NVIDIA stia sviluppando attivamente soluzioni di inferenza disaccoppiata con rivali più piccoli, NVIDIA ha dichiarato pubblicamente di essere ancora in grado di gestire quasi tutti i carichi di lavoro di intelligenza artificiale in modo più efficiente solo con i propri chip.Tuttavia, i fornitori di servizi cloud e le principali società di sviluppo dell'intelligenza artificiale come Anthropic e OpenAI non vogliono affidarsi interamente a un unico fornitore di chip. Oltre ad acquistare chip da altri produttori per ridurre la loro dipendenza da Nvidia, queste due società di intelligenza artificiale stanno anche sviluppando i propri chip di inferenza AI.
Il focus tecnico di d‑Matrix è la
decodifica speculativa
, questa tecnologia può migliorare la velocità di esecuzione dei modelli AI. In questo sistema congiunto che sarà lanciato da NVIDIA, il chip d-Matrix eseguirà un piccolo modello di intelligenza artificiale e prevederà in anticipo i risultati di output che il modello di grandi dimensioni dovrebbe fornire all'utente; mentre il modello grande funzionerà sulla GPU NVIDIA per verificare i risultati ipotizzati e confermarne l'adozione.Le informazioni riportavano in precedenza che d‑Matrix stava cercando un nuovo round di finanziamento in quel momento, con una valutazione post-money target di 5 miliardi di dollari; al momento non è chiaro se il finanziamento di Nvidia sarà incluso in questo round di finanziamento. L’ultimo round di finanziamento di d‑Matrix ha avuto luogo nel novembre 2025, raccogliendo 275 milioni di dollari, con una valutazione post-money di 2 miliardi di dollari. L'azienda ha completato la produzione in serie dei chip di prima generazione quest'estate e sta attualmente testando i chip di seconda generazione.
Commenti