Una svolta per l'intelligenza artificiale

La dominanza ineguagliata di Nvidia nel mercato non è ancora finita, ma sfidanti e alternative stanno emergendo da ogni angolo. ZML, startup francese molto attiva nel settore dell'intelligenza artificiale e sostenuta da Yann LeCun, vincitore dell'AW Turing, ha rilasciato un software che consente il funzionamento di diversi modelli open source di grandi modelli linguistici (large language models) su una varietà di chip — tra cui quelli di Nvidia, AMD, Google, Apple e Intel.

Con ZML/LLMD, il nuovo server di inferenza per grandi modelli di linguaggio (LLM), l'ambizione della società è rompere i cosiddetti silos esistenti resi obsoleti ed offrire l’accesso ai chip disponibili per applicazioni di intelligenza artificiale utilizzando le massime velocità possibili, e spesso ancora più rapide. Lo ha sottolineato Steeve Morin, fondatore di ZML, durante una recente intervista a TechCrunch.

Un'ottimizzazione fondamentale

Con l'integrarsi dell'intelligenza artificiale nelle nostre vite quotidiane e nei contesti lavorativi, l’ottimizzazione dell’inferenza – l’elaborazione delle richieste – ha guadagnato importanza rispetto al training modellare. Tuttavia dietro le quinte, rimane spesso frammentata, a causa di barriere software e architettoniche che conducono a una scarsa flessibilità. Per Morin, il promettere prestazioni di punta su una gamma variegata di chip è un tratto di straordinaria tecnologia, ma anche un potenziale disruptore del mercato al momento dell’aumentare delle preoccupazioni attorno ai costi dell’intelligenza artificiale.

ZML hopes to provide enterprises and clouds with the option to use a mix of chips, some of which might be less costly or consume less energy. “L’idea è restituire alle persone il potere di creare i loro propri sistemi e ottenere guadagni reali in termini di efficienza che permettano alle persone [AI] di essere diffusi in tutto il mondo,” ha continuato Morin.

Collaborazioni con nuovi produttori di chip in Europa

    • Axelera
    • Fractile
    • Kalray
    • OLIX
    • Q.ANT
    • SiPearl
    • SpiNNCloud
    • VSORA

Queste aziende, per lo più originarie dell’Europa, non sono state menzionate per il loro paese di origine. A lui interessa però che ZML possa collaborare con loro per portare a termine “cose che non sono mai state realizzate da nessun luogo al mondo”. Ciò non significa però essere critici verso Nvidia.

Il ruolo di ZML nel "gold rush" dell'inferenza

ZML non è scettica sulla posizione dominante di Nvidia, almeno in parte perché esiste un esistente mercato. Morin ha spiegato che ha con Nvidia una buona relazione, con questa azienda che sta gia preparandosi al crescente interesse per l'inferenza. L’inferenza è diventata un campo di tale intensa attenzione da essere definito il “gold rush” dell’intelligenza artificiale.

ZML, in questo contesto altamente concorrenziale, ha competitor come Baseten, valutata $13 miliardi; Inferact, proveniente dagli sviluppatori open source del progetto vLLM; e RadixArk, la azienda commerciale dietro SGLang. Entrambi vLLM e SGLang offrono una concorrenza parziale a LLMD, ma Morin ha una visione più ampia per ZML.

“Siamo arrived al punto dove co-progettiamo il silicio,” ha dichiarato Morin. E ha ringraziato il piccolo ma reattivo team di 20 persone per il rapido sviluppo e la capacità di lanciare nuove versioni in un breve lasso di tempo.

Un ambiente di lavoro ben finanziato

Il piccolo team ha beneficiato anche di un buon finanziamento per una simile struttura. Sfruttando la sua esperienza come vicepresidente del progetto Zenly, acquisito da Snapchat per cifre significative nel 2017, Morin ha raccolto 20 milioni di dollari da aziende di venture capital come Harry Stebbings’ 20VC, >commit, AALVC, Drysdale Ventures, Kima Ventures di Xavier Niel, Kindred Capital, LocalGlobe, e Puzzle Ventures.

A differenza del primo progetto pubblico di ZML, il framework ML incentrato sull'inferenza lanciato nel 2024 e aggiornato a marzo, ZML/LLMD non è open source. Tuttavia è stato lanciato come prodotto gratuito, con l’obiettivo di apprendere il consumo utente. “Sarei contento di misurare, e poi generare ricavi laddove esso sia più redditizio, senza ostacolare la mia crescita inutilmente, perché troppo avido fin dall’inizio,” ha detto Morin.

Una prospettiva europea

È ancora troppo presto per capire quando ZML/LLMD potrebbe trasformarsi in un prodotto a pagamento e come si diffonderà. Ma è chiaro che altri fondatori stanno osservando il movimento. Fra questi, il fondatore di Dagger e Docker, Solomon Hykes, Clément Delangue e Julien Chaumond di Hugging Face, e ovviamente, Yann LeCun, affiliato ad AMI Labs.

“Non avrei potuto creare ZML in nessun altro posto al mondo, ma solo a Parigi,” ha concluso Morin, sottolineando come l’Europa oggi riesca a costruire innovazione senza doversi spostare negli Stati Uniti per trovare opportunità.