Con l'intelligenza artificiale che passa da uno stadio di sviluppo a prodotti completi, la richiesta di capacità di calcolo cresce esponenzialmente, muovendosi verso fabbriche AI in grado di generare token in modo continuo. Questo aumento di domanda richiede un accesso a infrastrutture di calcolo accelerate su larga scala, a basso costo e in grado di supportare servizi basati sui token.
Difficoltà storiche
Storicamente, le aziende emergenti nell’ambito AI incontrano barriere nell’accesso a infrastrutture impegnative sotto il profilo finanziario. Addirittura, impegni a lungo termine non sono bastati a garantire accesso a calcolatori sufficienti.
Lo scenario cambia grazie a NVIDIA
Per affrontare questa situazione, NVIDIA presenta una strategia innovativa volta ad aprire l’accesso al calcolo ad un ecosistema in rapida crescita di start-up, costruttori di modelli, imprese, organizzazioni di ricerca e operatori regionali nell’ambito AI. Queste infrastrutture cloud accedono a risorse NVIDIA di grande scala, allineate su modelli di economia che includono condivisione dei ricavi e supporto alle credenziali.
Modello di collaborazione
Attraverso questa collaborazione, le aziende cloud vendono servizi in nuvola forniti tramite le fabbriche AI NVIDIA DSX, che producono token in modo su larga scala. Questo non solo accelera l’adozione delle piattaforme NVIDIA tra i clienti, ma fornisce anche alle aziende cloud un percorso efficiente nel senso finanziario per espandersi. NVIDIA, invece, ottiene un nuovo e ricorrente flusso di entrate legato all’utilizzo.
Vantaggi per i costruttori di modelli
Per i costruttori di modelli, fornitori di inferenza, piattaforme agente e aziende che espandono la loro AI, si potrebbe significare un accesso più rapido al calcolo accelerato su tutta la pila, senza dover attendere la selezione del sito, l’approvvigionamento energetico, la costruzione o l’attivazione dell’hardware.
Capacità e nuove strutture
L’iniziativa è già in fase di avvio, con aziende cloud che costruiscono complessi industriali DSX AI progettati per servire clienti e carichi di lavoro in diverse regioni. Sharon AI e Firmus sono tra le prime aziende a collaborare con NVIDIA su questa strategia.
- Sharon AI sta implementando fino a 40.000 GPU NVIDIA Grace Blackwell GB300.
- James Manning, co-fondatore e CEO di Sharon AI, ha dichiarato che questa collaborazione è un momento significativo per il percorso della sua azienda verso il provisioning infrastrutturale AI su larga scala.
- Firmus è in costruzione un campus di fabbriche AI DSX nel Batam, Indonesia, con un piano espansivo fino a 360 megawatt e massimo 170.000 GPU NVIDIA.
- Tim Rosenfield, co-CEO di Firmus Technologies, ha sottolineato che le aziende native AI necessitano di infrastrutture di calcolo scalabili, efficienti in termini energetici e di costo per competere sul mercato globale.
Tendenze future
Aziende native AI, come Baseten, Fireworks AI e Together AI, mostrano la direzione in cui si sta spostando la richiesta di calcolo: hanno bisogno di accesso immediato alla capacità cloud AI per realizzare training, post-training, sintonizzazione fine e inferenza in larga scala. I loro clienti richiedono un accesso affidabile a larga NVIDIA computing accelerata, ma anche flessibilità economica mentre i prodotti passano dalla fase pilota a produzione.
Contattare Sharon AI e Firmus
Per garantire la capacità di calcolo e costruire e distribuire modelli AI, è possibile contattare direttamente Sharon AI e Firmus.
I dati completi
Per saperne di più sui partner cloud NVIDIA e sulle strutture AI, visitare i rispettivi collegamenti forniti.