// TOM'S HARDWARE ITALIA — INTELLIGENZA ARTIFICIALE
Il traduttore AI di Alibaba parla quasi come un interprete umano (ma si paga a consumo)
Il team Qwen di Alibaba ha rilasciato il 19 settembre 2026 Qwen3.8-LiveTranslate, un nuovo modello di interpretazione simultanea che genera la traduzione mentre l'interlocutore sta ancora parlando, senza aspettare la fine della frase. Rispetto alla generazione precedente la latenza media scende da 2,8 a 2,3 secondi, misurata come LAAL (Length-Adaptive Average Lagging), un miglioramento del 18% su 60 lingue in ingresso, di cui 29 restituite anche in voce. Il dato, riportato insieme alle nuove funzioni di riconoscimento dei parlanti e disambiguazione contestuale, va letto contro un altro numero: l'ear-voice-span tipico di un interprete umano professionista è di 2-6 secondi, quindi il modello si colloca già dentro quel range.
Qwen3.8-LiveTranslate è un modello closed-weight, distribuito solo come API a consumo su Alibaba Cloud Model Studio e su QwenCloud, con endpoint sia a Singapore sia a Pechino: è già utilizzabile fuori dalla Cina da chiunque apra un account cloud, ma il costo è per token. Il listino di Singapore arriva fino a 30 dollari per milione di token audio in output: un'ora continuativa di conversazione tradotta, voce in ingresso e in uscita, costa circa 1,54 dollari, prima dei token di testo e immagini, cifra ricalcolata anche da un'analisi tecnica indipendente.
Alibaba dichiara che il modello ha superato la generazione precedente e alcuni sistemi concorrenti sul dataset FLEURS, 70 lingue. È un dato aziendale, non una verifica indipendente: il confronto è interno, condotto dalla stessa azienda che vende il prodotto, e va preso con beneficio d'inventario finché un ente terzo non lo replica con gli stessi criteri. La LAAL, va ricordato, misura solo il ritardo della traduzione rispetto al parlato originale, non la fedeltà semantica di quello che viene effettivamente tradotto: i due dati non vanno confusi, e sul secondo Alibaba non fornisce numeri comparabili.
Il confronto con l'ear-voice-span umano regge sul dato che conta di più per un ascoltatore, cioè quanto tempo passa prima che la traduzione arrivi. Ma un interprete professionista non si limita a essere veloce: riformula, sceglie i termini giusti per il contesto e corregge in tempo reale gli equivoci, funzioni che nessun confronto pubblicato da Alibaba misura direttamente. Il paragone con l'interpretariato umano, insomma, vale sulla velocità e si ferma lì.
Un pezzo precedente si era già chiesto, con questo stesso confronto, quanto l'AI possa davvero sostituire un traduttore umano, concludendo che la risposta dipende dal tipo di conversazione e dalla tolleranza per l'errore occasionale. Altri prodotti hanno già affrontato lo stesso problema da angolazioni diverse: Google Meet traduce in tempo reale mantenendo il timbro vocale di chi parla, mentre Vasco Audience punta sulle conferenze con un relatore e un pubblico multilingue.
Non è la prima mossa aggressiva di Alibaba sui modelli linguistici: ha già aperto i pesi del proprio modello di punta da 2,4 trilioni di parametri, e ad agosto Qwen aveva già conquistato la vetta nei test di coding. LiveTranslate segue lo stesso schema commerciale: pubblicare presto, con numeri di parte, e lasciare che siano gli utenti enterprise a stabilire se il prodotto regge sul campo.
Per un'azienda che valuta il modello per il proprio customer service multilingue, il conto pratico si fa per minuto: 1,54 dollari l'ora è una cifra bassa rispetto a un interprete umano, ma resta da vedere quanto lavoro di correzione serva dopo la traduzione automatica, specie su terminologia tecnica o legale dove la LAAL bassa non basta a garantire un risultato utilizzabile senza revisione.
Aggiungi Tom's Hardware alle tue fonti preferite su Google
Alibaba lancia Qwen3.8-LiveTranslate, un'AI di interpretazione simultanea che abbassa la latenza a 2,3 secondi su 60 lingue, ma resta disponibile solo come API a consumo.