Mistral AI ha rilasciato un nuovo modello open-source per la sintesi vocale AI

Si chiama Voxtral TTS e supporta nove lingue

2 min.

Mistral AI ha rilasciato un nuovo modello open-source per la sintesi vocale AI

La startup francese Mistral AI ha lanciato Voxtral TTS, un modello di intelligenza artificiale open source per la sintesi vocale che punta a ribaltare gli equilibri in un mercato fino ad oggi dominato da nomi statunitensi come ElevenLabs, Deepgram e OpenAI. L’azienda parigina lo definisce come il primo modello conversione testo-voce di qualità di frontiera con pesi aperti, pensato esplicitamente per le imprese.

Voxtral TTS supporta nove lingue, tra cui italiano, francese, tedesco, spagnolo e hindi, e può girare su smartwatch, smartphone e laptop. Una delle caratteristiche più notevoli è la capacità di clonare una voce partendo da un campione audio di meno di cinque secondi, mantenendone accento, intonazione e cadenza anche quando si passa da una lingua all’altra. Prestazioni che si traducono in numeri concreti. Il modello impiega infatti appena 90 millisecondi prima di produrre il primo audio. “Il costo è una frazione rispetto a qualsiasi altro prodotto sul mercato, ma offre performance all’avanguardia”, ha dichiarato Pierre Stock, vicepresidente per le operazioni scientifiche di Mistral AI.

L’ambizione di Mistral va però oltre il singolo modello. Stock ha descritto una visione in cui l’audio diventa l’interfaccia naturale per gli agenti AI in previsione di un futuro in cui il mercato si svilupperà maggiormente in questa direzione. “Vediamo l’audio come una grande scommessa e forse come la sola interfaccia del futuro con i modelli AI“, ha aggiunto Stock. Con Voxtral TTS che completa la gamma, già composta da modelli di trascrizione e un layer linguistico, Mistral ha ora una sequenza vocale completa, da eseguire interamente senza dipendere da server esterni.

Mistral ha lanciato Forge: una piattaforma che permette alle aziende di costruire modelli AI su misura

A differenza degli approcci più diffusi Forge permette di costruire…


Articoli simili

Ultime news


Meta è in un vicolo cieco?

Licenziamenti, addii eccellenti, prodotti accantonati e conti traballanti: cosa è…

Google lancia Gemini 3.5 Transcribe: addio a “ehm” e pause

Google ha presentato Gemini 3.5 Transcribe, il suo nuovo modello…

AWS e NVIDIA: 2 milioni di GPU in più per l’AI agentiva e fisica

AWS e NVIDIA hanno annunciato il dispiegamento di altri 2…

La startup che ha creato un’AI addestrata a “pensare come l’universo”

Accelerated Understanding ha elaborato un modello che ragiona per equazioni…

Perplexity porta il suo agente AI sul DGX Spark: tutto gira in locale

Perplexity ha lanciato Portable Computer, una versione del suo agente…

In Evidenza


New York contro i data center (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

"Se potessi tornare indietro, eliminerei l'espressione 'intelligenza artificiale', la chiamerei…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version