Alibaba présente Qwen3.8-LiveTranslate, modèle d'interprétation simultanée qui ramène la latence moyenne de 2,8 à 2,3 secondes sur 60 langues
Le 18 septembre 2026, l'équipe Qwen d'Alibaba a présenté Qwen3.8-LiveTranslate, un modèle d'interprétation simultanée construit sur une architecture dite Interleave. Le billet officiel indique que la latence moyenne (average lagging, LAAL) tombe de 2,8 à 2,3 secondes, sur une base de 60 langues déjà couvertes. Trois fonctions s'ajoutent : la séparation des locuteurs en temps réel, avec attribution de chaque phrase, l'affichage simultané du texte source et de sa traduction sur un écran bilingue, et la levée d'ambiguïté par le contexte long pour les noms propres et la terminologie. Le dispositif associe deux modules Thinker et Talker à base de MoE hybride, le second resynthétisant la traduction dans le timbre de l'orateur. Le modèle est servi par l'API DashScope. Alibaba affirme devancer les systèmes d'interprétation temps réel du marché sur le jeu public FLEURS, évalué sur 70 directions de traduction, et sur l'ensemble multilocuteur Omnilingua-MSpeaker, qui en couvre 14.

























