Arriva LLMD, il software di una startup francese che sfida il monopolio di Nvidia nell’AI

LLMD è un server di inferenza open source e gratuito progettato per eseguire modelli linguistici su piattaforme hardware differenti

4 min.

Arriva LLMD, il software di una startup francese che sfida il monopolio di Nvidia nell’AI

Il mercato dell’intelligenza artificiale si gioca sempre più sull’infrastruttura. Se negli ultimi anni l’attenzione si è concentrata sui modelli linguistici e sulle loro capacità, oggi la vera competizione si sta spostando su un altro terreno, quello dell’inferenza. È la fase in cui un modello già addestrato genera risposte agli utenti, un’attività che rappresenta ormai una delle principali voci di costo per aziende e fornitori di servizi AI.

In questo scenario si inserisce la francese ZML, startup sostenuta anche dal premio Turing Yann LeCun, che ha annunciato il rilascio di LLMD, un server di inferenza open source e gratuito progettato per eseguire modelli linguistici su piattaforme hardware differenti. L’obiettivo dichiarato è semplice quanto ambizioso. Ridurre la dipendenza da un singolo produttore di chip e consentire alle imprese di sfruttare qualsiasi acceleratore disponibile senza dover riscrivere il software.

LLMD è compatibile con GPU Nvidia e AMD, con le TPU di Google, con Apple Metal e con Intel Arc. Non si tratta quindi di un nuovo modello AI, bensì di un’infrastruttura software che gestisce l’esecuzione dei modelli esistenti, ottimizzando l’utilizzo delle risorse di calcolo e cercando di ottenere le migliori prestazioni indipendentemente dall’hardware utilizzato.

La novità arriva in un momento in cui il mercato continua a essere dominato da Nvidia. La maggior parte dei framework AI è infatti costruita intorno a CUDA, la piattaforma software dell’azienda statunitense, creando un forte fenomeno di cosiddetto “vendor lock-in“. In pratica, molte organizzazioni finiscono per acquistare esclusivamente GPU Nvidia perché l’intero ecosistema software è ottimizzato per quelle architetture.

Secondo Steeve Morin, fondatore di ZML, è proprio questo il problema che la startup vuole affrontare. «L’inferenza è frenata da barriere architetturali e software che creano silos tra i diversi produttori di chip», spiega Morin. L’obiettivo di LLMD è quindi massimizzare le prestazioni disponibili su qualunque acceleratore, eliminando la necessità di scegliere un unico ecosistema hardware.

Il tema non riguarda soltanto la libertà di scelta. Per molte aziende significa anche ridurre sensibilmente i costi operativi. L’inferenza rappresenta infatti la fase che viene eseguita milioni di volte al giorno dai chatbot, dagli assistenti virtuali e dalle applicazioni AI. Anche piccoli miglioramenti nell’efficienza possono tradursi in risparmi economici molto rilevanti.

Negli ultimi mesi il settore ha iniziato a considerare l’ottimizzazione dell’inferenza come una delle principali aree di innovazione. Diverse startup stanno sviluppando strumenti dedicati proprio a questa fase, cercando di aumentare il numero di token elaborati al secondo e di ridurre il consumo energetico dei data center. Non è un caso che progetti open source come vLLM e SGLang abbiano attirato un crescente interesse da parte dell’industria e degli investitori.

Per ZML, tuttavia, la differenza consiste nell’offrire un’unica piattaforma capace di funzionare in maniera nativa su architetture molto diverse tra loro. Sul repository ufficiale GitHub l’azienda descrive il progetto con uno slogan che sintetizza la filosofia del prodotto. Any model. Any hardware. Zero compromise, ovvero qualsiasi modello, qualsiasi hardware, senza compromessi.

L’annuncio rappresenta anche un segnale della crescente vitalità dell’ecosistema europeo dell’AI. Negli ultimi anni il continente ha cercato di ritagliarsi uno spazio non tanto nella corsa ai modelli di frontiera, quanto nello sviluppo di strumenti, software e infrastrutture in grado di rendere più efficiente l’intera filiera dell’intelligenza artificiale.

Resta naturalmente da verificare se LLMD riuscirà a mantenere le promesse anche nei carichi di lavoro reali. Le aziende valuteranno soprattutto le prestazioni rispetto alle soluzioni già consolidate e la semplicità di integrazione nei sistemi esistenti. Se i risultati saranno all’altezza delle aspettative, la sfida lanciata da ZML potrebbe contribuire a ridurre uno dei principali colli di bottiglia dell’AI moderna, aprendo la strada a un mercato meno dipendente da un solo produttore di chip e più aperto alla concorrenza.


Articoli simili

Ultime news


Nvidia punta 7 miliardi su Poolside AI: licenza, talenti e modelli aperti

Nvidia ha siglato un accordo da 7 miliardi di dollari…

Nvidia punta 7 miliardi su Poolside AI: licenza, talenti e modelli aperti
OpenAI lancia AI Futures: il think tank interno sulla governance dell’IA

OpenAI ha lanciato AI Futures, il blog del suo nuovo…

OpenAI lancia AI Futures: il think tank interno sulla governance dell’IA
L’harness batte il modello: Nvidia porta Claude Opus 5 al 100%

Nvidia ha dimostrato che l'architettura che avvolge un modello AI…

L’harness batte il modello: Nvidia porta Claude Opus 5 al 100%
Ode with Anthropic acquisisce Casper Studios: la prima mossa nell’enterprise

Ode with Anthropic, la joint venture sostenuta da Blackstone e…

Ode with Anthropic acquisisce Casper Studios: la prima mossa nell’enterprise
Nvidia, server AI oltre il 15% più cari: colpa della memoria

I server con chip AI di Nvidia aumenteranno di oltre…

Nvidia, server AI oltre il 15% più cari: colpa della memoria

In Evidenza


New York contro i data center (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

New York contro i data center (e altre notizie generative) | Weekly AI
Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo
Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News
AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

AI, bolla o non bolla? Il parere degli esperti non è unanime
Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

"Se potessi tornare indietro, eliminerei l'espressione 'intelligenza artificiale', la chiamerei…

Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

Privacy policy| Cookie policy| Cookie setting| © 2026