d-Matrix adotta NVIDIA NVLink Fusion per la distribuzione Raptor XPU

d-Matrix, azienda specializzata nello sviluppo di chip per l'inferenza intelligente, ha annunciato oggi che utilizzerà NVIDIA NVLink Fusion per connettere i suoi XPU Raptor di prossima generazione all'infrastruttura AI di NVIDIA, unendosi a un crescente numero di partner dell'ecosistema. Questo annuncio rappresenta un passo significativo nel panorama dell'inferenza AI, dove la domanda continua a crescere esponenzialmente mentre le risorse rimangono finite.

Collegando Raptor a NVIDIA NVLink per lo scale-up e alla rete Spectrum-X per lo scale-out, insieme all'architettura rack NVIDIA MGX e alla più ampia piattaforma AI di NVIDIA, NVLink Fusion offre a d-Matrix un percorso accelerato e a minor rischio, dalla creazione di silicio personalizzato fino alla distribuzione su larga scala. Questa strategia rappresenta una soluzione elegante ai complessi problemi di integrazione che le aziende di chip affrontano quando cercano di portare le loro innovazioni al mercato su scala industriale.

La visione di d-Matrix per l'inferenza ultracompetitiva

"La domanda di inferenza sta raggiungendo livelli straordinari, ma il capitale, il tempo e l'energia rimangono risorse finite," ha dichiarato Sid Sheth, cofondatore e CEO di d-Matrix durante una conferenza stampa tenuta ieri. "Con NVLink Fusion e MGX, possiamo integrare i nostri XPU Raptor in un'architettura a raffreddamento a liquido ampiamente distribuita, fornendo ai clienti un percorso più veloce e a minor rischio per distribuire e scalare l'inferenza a latenza ultrabassa."

Le parole di Sheth catturano perfettamente la sfida fondamentale che affrontano le aziende che innovano nel campo dell'intelligenza artificiale. Non è sufficiente sviluppare chip avanzati; occorre anche avere la capacità di distribuirli efficacemente in ambienti di produzione complessi. NVLink Fusion affronta direttamente questa problematica, creando un ponte tra l'innovazione nel design dei processori e la pratica operativa della distribuzione su larga scala.

La piattaforma AI di NVIDIA: verticalmente integrata, orizzontalmente aperta

La piattaforma AI di NVIDIA è costruita secondo un principio fondamentale: verticalmente integrata per garantire coesione e prestazioni, ma orizzontalmente aperta per accogliere innovatori come d-Matrix. NVLink Fusion estende ulteriormente questa apertura agli XPU e ai CPU, permettendo alle aziende di chip di concentrarsi esclusivamente sulle loro innovazioni nei processori, mentre utilizzano l'infrastruttura di NVIDIA per distribuirle su scala industriale.

Questo approccio rappresenta un paradigma importante nell'industria dei semiconduttori e dell'intelligenza artificiale. Piuttosto che forzare tutti i produttori a utilizzare specifici design di processore, NVIDIA ha creato uno stack tecnologico sufficientemente flessibile da accogliere diverse architetture, a condizione che si integrino attraverso interfacce standardizzate come NVLink Fusion. Questo modello accelera l'innovazione complessiva dell'ecosistema, poiché riduce il rischio e i costi per i nuovi attori nel mercato.

Dal silicio personalizzato alla distribuzione su scala rack

La creazione di un XPU rappresenta solo il primo passo in un viaggio molto più complesso. Distribuire un processore personalizzato su scala industriale richiede una piattaforma completa che comprenda reti, architettura rack, alimentazione, raffreddamento, software e una catena di fornitura comprovata. Ogni fase del processo — dall'approvvigionamento dei chip, all'integrazione di interfacce ad alta velocità, alla convalida di una soluzione di networking scale-up, fino alla progettazione e certificazione dell'architettura rack — aggiunge tempo, costi e rischi significativi.

NVLink Fusion consente agli innovatori nel campo del silicio di connettersi direttamente alla piattaforma comprovata di NVIDIA. È la tecnologia ad alta larghezza di banda e bassa latenza che connette gli XPU e CPU personalizzati allo stack di NVIDIA. Questo approccio elimina la necessità di reinventare l'intera infrastruttura per ogni nuovo processore che viene introdotto sul mercato.

Adottando NVLink Fusion, d-Matrix può accedere agli ecosistema NVIDIA MGX, con i suoi design rack maturi e convalidati, alla catena di fornitura, all'infrastruttura di alimentazione e raffreddamento già stabiliti. Un vantaggio cruciale per i data center è la capacità di standardizzare su un rack comune, che può supportare GPU, CPU e XPU senza richiedere un'architettura rack separata per ogni tipo di processore. Questa standardizzazione riduce i costi operativi, semplifica la manutenzione e accelera il deployment.

L'integrazione di d-Matrix negli ecosistema NVIDIA

Utilizzando NVIDIA NVLink, d-Matrix prevede di connettere i suoi XPU in un singolo dominio scale-up ad alta larghezza di banda e bassa latenza. I suoi rack possono anche funzionare insieme ai sistemi basati su GPU di NVIDIA, come l'NVIDIA Vera Rubin NVL72, per l'inferenza disaggregata. Questo approccio di disaggregazione consente ai data center di mescolare e abbinare diversi tipi di processori a seconda dei carichi di lavoro specifici, ottimizzando sia le prestazioni che l'efficienza energetica.

d-Matrix prevede inoltre di integrare ulteriori tecnologie NVIDIA nel suo ecosistema:

  • NVIDIA Vera CPU: per la capacità di elaborazione CPU complementare
  • NVIDIA ConnectX-9 SuperNIC: per la connettività di rete ultra-veloce
  • NVIDIA BlueField-4 DPU: per l'elaborazione dati distribuita e la sicurezza
  • NVIDIA Spectrum-X Ethernet: per la rete Ethernet specializzata in AI

Insieme con NVLink e MGX, queste tecnologie forniscono a d-Matrix una fondazione comprovata per distribuire l'inferenza specializzata insieme ai sistemi di NVIDIA all'interno di fabbriche AI flessibili e unificate. Questa integrazione profonda crea un ecosistema coeso in cui ogni componente è ottimizzato per funzionare insieme, garantendo prestazioni e affidabilità di livello produttivo.

L'apertura delle fabbriche AI di NVIDIA alle architetture XPU specializzate

NVLink Fusion rappresenta un punto di svolta cruciale nell'apertura delle fabbriche AI di NVIDIA. Tradizionalmente, i data center AI sono stati costruiti attorno a GPU specifiche, ma NVLink Fusion cambia questo paradigma permettendo una vera eterogenità di processori all'interno della stessa architettura infrastrutturale.

La piattaforma completa di fabbrica AI di NVIDIA include una suite impressionante di componenti:

  • NVIDIA Vera Rubin NVL72: sistema di rack GPU di prossima generazione per carichi di lavoro intensivi
  • Groq 3 LPX: processore specializzato per l'elaborazione ad alto parallelismo
  • Vera CPU rack: infrastruttura CPU dedicata
  • Vera BlueField-4 STX: soluzione di storage e elaborazione dati
  • Spectrum-6 SPX Ethernet: rete Ethernet di prossima generazione per il networking ad altissima velocità

Questa piattaforma è progettata per essere completamente fungibile — in grado di eseguire ogni carico di lavoro AI, modello e architettura di modello — mantenendo le migliori prestazioni per watt e il costo più basso per token. La fungibilità è un concetto chiave: significa che i data center non sono bloccati in un singolo tipo di processore, ma possono invece adattare l'infrastruttura ai loro carichi di lavoro specifici.

Flessibilità e riduzione dei rischi

NVLink Fusion offre ai clienti la flessibilità di abbinare il calcolo giusto a ogni carico di lavoro all'interno di una piattaforma di fabbrica AI comune. Questo apre l'accesso alla rete NVIDIA, ai sistemi, al software e alla catena di fornitura globale di NVIDIA. Gli innovatori nel campo del silicio, come d-Matrix, possono utilizzare NVLink Fusion per aumentare le prestazioni, accelerare il time-to-market e ridurre il rischio di distribuzione di fabbriche AI semi-personalizzate.

Per d-Matrix, i benefici sono sostanziali. Anziché dover costruire da zero l'intera infrastruttura di distribuzione, potendo fare affidamento sulla piattaforma NVIDIA comprovata, l'azienda può accelerare significativamente il suo go-to-market. Questo è particolarmente importante nel settore dell'intelligenza artificiale, dove la velocità di innovazione è eccezionalmente elevata e le finestre di opportunità possono essere strette.

Conclusione: un nuovo modello per l'innovazione AI

L'adozione di NVLink Fusion da parte di d-Matrix rappresenta un momento significativo nell'evoluzione dell'industria AI. Dimostra che NVIDIA non sta solo costruendo prodotti per il futuro dell'AI, ma sta anche creando un ecosistema che consente ad altre aziende di innovare e competere. Questo approccio è healthier per l'industria complessiva, poiché incoraggia la specializzazione e l'innovazione senza richiedere investimenti astronomici in infrastrutture di distribuzione.

Mentre la domanda di inferenza AI continua a crescere esponenzialmente, soluzioni come NVLink Fusion diventeranno sempre più critiche per garantire che l'innovazione nel design dei chip possa essere tradotta rapidamente in valore reale per i clienti. d-Matrix, con i suoi XPU Raptor ottimizzati per l'inferenza a bassa latenza, è ben posizionata per capitalizzare su questa opportunità e portare nuove capacità di elaborazione ai data center di tutto il mondo.