Close-up van een zwarte studiomicrofoon voor spraakopname
Nieuws20 september · 16:114 min leestijd

Qwen brengt LiveTranslate uit voor realtimevertaling in 60 talen

Qwen maakt realtimevertaling beschikbaar als gehoste API. Het model begrijpt 60 talen, spreekt er 29 uit en verlaagt volgens Qwen de gemiddelde vertaalachterstand naar 2,3 seconden.

Qwen3.8-LiveTranslate brengt realtimevertaling naar een gehoste API, meldt Qwen, met 60 begrijptalen, 29 talen met spraakuitvoer en een door Qwen gemeten gemiddelde achterstand van 2,3 seconden.

Voor een Nederlandse ondernemer maakt dat meertalige klantgesprekken, verkoopdemo's en internationale teams rechtstreeks vertaalbaar binnen één digitale stroom. De aparte keten van opname, transcriptie en vertaling wordt daarmee voor deze toepassing minder noodzakelijk. De grens zit meteen in de specificatie: 31 van de 60 talen leveren tekst, maar geen gesproken vertaling.

Live vertalen tijdens het gesprek

Qwen bouwt de release rond een zogenoemde Interleave-architectuur, die luisteren en vertalen nauwer verweeft. De release voegt ook sprekerherkenning, een gesynchroniseerde tweetalige weergave en context over langere gesprekken toe. Namen en vaktermen die vroeg in een gesprek vallen, moeten daardoor later consistenter terugkomen.

De nieuwe dienst staat naast Qwen3.8-Omni-Flash, dat tekst, beeld, audio en video via één API met een contextvenster van een miljoen tokens verwerkt. Omni-Flash is bedoeld voor multimodale analyse en agenttaken. LiveTranslate richt zich op het gelijktijdig omzetten van gesproken taal naar tekst en spraak.

Wat betekent 2,3 seconden?

Volgens de releasebeschrijving daalt de gemiddelde LAAL-vertraging van 2,8 naar 2,3 seconden. Dat is een daling van ongeveer 18 procent. LAAL staat voor Length-Adaptive Average Lagging en meet hoe ver de vertaling gemiddeld achterloopt op de bronspraak, niet de volledige wachttijd van een gesprek of de totale tijd tot een antwoord.

Voor een klantgesprek is 2,3 seconden dus geen vaste belofte dat elke zin precies zo lang op zich laat wachten. Accenten, geluidskwaliteit, taalpaar, beurtwisseling en de uiteindelijke audio-uitvoer blijven onderdeel van de keten. Het cijfer beschrijft de gemiddelde achterstand in de meting van Qwen, niet een gegarandeerde eind-tot-eindlatentie.

De API is beschikbaar

De Alibaba Cloud-documentatie van 19 september zet qwen3.8-livetranslate-flash-realtime in Model Studio als beschikbaar model. Ontwikkelaars roepen het aan via de WebSocket Realtime API. QwenCloud toont dezelfde modelnaam, met audio en beeld als invoer en tekst en audio als uitvoer. De huidige Model Studio-pagina noemt functieaanroepen, gestructureerde uitvoer, batchverwerking en fijnafstemming nog niet beschikbaar. De dienst is daarmee een gerichte vertaalcomponent, geen complete agentruntime.

De internationale prijstabel van QwenCloud rekent 7,50 dollar per miljoen tokens voor audio-invoer, 0,55 dollar voor beeldinvoer, 20 dollar voor tekstuitvoer en 30 dollar voor audiouitvoer. De internationale limiet staat op tien verzoeken en 100.000 tokens per minuut. Dat maakt de prijs afhankelijk van de hoeveelheid spraak, context en uitvoer, niet van een eenvoudig vast bedrag per minuut.

Van vertaling naar werkstroom

Voor bedrijven met klanten, leveranciers of collega's in meerdere talen verandert de rol van vertaling hiermee. Het resultaat hoeft niet te eindigen als ondertiteling of een los transcript, maar kan direct tekst en spraak leveren aan een klantenservice, vergaderscherm of volgende softwarestap.

De specificatie bepaalt wel hoe breed die inzet is. 60 talen betekent niet 60 gesproken talen, en 2,3 seconden betekent niet dat elke volledige interactie die vertraging houdt. Qwen schuift realtimevertaling daarmee op van losse hulpfunctie naar een API-laag die in klantcontact en samenwerking kan worden ingebouwd. De keuze voor een vertaaloplossing gaat dan niet meer alleen over taaldekking, maar ook over welke uitvoer een werkstroom nodig heeft.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Taal als werkstroom

Ik denk mee over hoe realtime vertaling in jouw klantcontact of teamproces past, ontwerp de koppeling en bouw het geheel end-to-end. Waar het kan houd ik data en onderdelen self-hosted, zodat de werkstroom van idee tot live product klopt.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Alibaba scherpt Qwen3.8-Max aan voor code en houdt de prijs gelijk
Nieuws
4

3 sep 04:34

Alibaba scherpt Qwen3.8-Max aan voor code en houdt de prijs gelijk

Alibaba brengt Qwen3.8-Max-0902 uit, een codeversie van zijn topmodel tegen ongewijzigde tarieven van 2 en 6 dollar per miljoen tokens. De geclaimde eerste plek op Arena hield precies één dag stand.

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens
Nieuws
5 min

27 aug 02:22

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens

Alibaba zet de gewichten van Qwen3.8-Flash-Next open. Het model activeert 6 van 176 miljard parameters per token, kost gehost 0,16 dollar per miljoen invoertokens en komt met een strakkere licentie dan het vlaggenschip.

Qwen3.8-Omni-Flash maakt audio- en video-agents goedkoper
Nieuws
4 min

19 sep 18:21

Qwen3.8-Omni-Flash maakt audio- en video-agents goedkoper

Qwen3.8-Omni-Flash brengt audio en video samen met een miljoen-tokencontext, toolgebruik en een goedkope API. De release maakt multimodale agents voor Nederlandse teams toegankelijker, maar benchmarkcijfers komen uit leveranciersmetingen.

Anthropic meldt 151 miljoen Claude-uitwisselingen in distillatiecampagne
Nieuws
5 min

11 sep 00:27

Anthropic meldt 151 miljoen Claude-uitwisselingen in distillatiecampagne

Anthropic zegt dat drie nieuwe Claude-distillatiecampagnes samen tientallen miljoenen uitwisselingen omvatten. De cijfers maken modelherkomst, datarouting en leveranciersrisico concreet voor Nederlandse organisaties die Chinese AI-modellen of tussenlagen gebruiken.

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld
Inzicht
7 min

15 aug 17:00

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld

Qwen, Kimi, Llama en Gemma zetten voorwaarden op je omzet, je gebruikersaantal en je merknaam. Een gratis model met een drempel is geen open source, maar een inkoopbeslissing die je vooruitschuift naar het moment dat je niet meer weg kunt.

China overweegt exportcontroles op AI-modellen en chips
Nieuws
3 min

21 jul 10:25

China overweegt exportcontroles op AI-modellen en chips

China overweegt strengere exportcontroles op zowel zijn AI-modellen als zijn chips, meldt de Financial Times. Een verharding voorbij de eerdere toegangsbeperking, die bedrijven raakt die op goedkope Chinese open modellen zijn gaan bouwen.