Frans-Canadees QWERTY-toetsenbord met accenttekens op een zilveren laptop.
Nieuws1 oktober · 11:182 min leestijd

Bilibili opent Index-Translate voor tekst in 150 talen

Bilibili publiceert open gewichten voor tekstvertaling in 150 talen. Organisaties kunnen het model lokaal inzetten, maar spraak en volledige documenten zijn beperkt tot kleinere groepen taalrichtingen.

Bilibili’s Index LLM-team opent Index-Translate als open gewichten voor tekstvertaling in 150 talen, met 2B- en 9B-modellen en een 35B-A3B-preview, blijkt uit de release van 30 september.

Voor teams met vertrouwelijke klantteksten verandert vooral waar vertaling kan draaien: de modellen zijn op eigen infrastructuur te gebruiken, zodat invoer niet per se naar een gehoste vertaaldienst hoeft. Dat geeft meer controle over de verwerkingslocatie, maar brengt ook GPU-capaciteit en modelbeheer naar de organisatie. IndexTeam noemt voor de 2B-versie circa 8 GB GPU-geheugen in BF16 als startpunt, met extra nodig voor langere invoer en de bijbehorende cache.

Tekstmodellen voor gestructureerde inhoud

Index-Translate is gebouwd op Qwen3.5. De tekstmodellen volgen aanwijzingen om termen, opmaak, code en tijdelijke aanduidingen te behouden. Dat is relevant voor productnamen en bestanden als JSON, waarin een vertaalde veldnaam of variabele de volgende verwerkingsstap kan verstoren.

In Bilibili’s eigen test voor taalparen met weinig beschikbare trainingsdata, met 104.000 invoeren over 1.040 richtingen in 62 talen, had de 35B-A3B-preview 2,4% uitvoer in een andere doeltaal dan gevraagd, tegenover 4,2% bij 2B. Die percentages meten of het model de gevraagde doeltaal gebruikt, niet de volledige vertaalkwaliteit. Het zijn resultaten uit Bilibili’s eigen evaluatie, geen onafhankelijke meting.

Bilibili’s grafiek vergelijkt drie modelgroottes op acht vertaalbenchmarks., Bilibili Index LLM
Bilibili’s grafiek vergelijkt drie modelgroottes op acht vertaalbenchmarks., Bilibili Index LLM

De taalgrens verschilt per model

De 150 talen gelden alleen voor tekst. Het ondertitelpakket vertaalt vanuit het Chinees naar Engels, Japans of Spaans. Spraak naar spraak ondersteunt Chinees naar die drie talen en Engels naar Chinees, Spaans of Japans. Voor complete documenten noemt Bilibili alleen Chinees-Engels en Chinees-Japans. Bilibili’s site beschrijft de smallere taaldekking van de spraak- en documentvarianten.

Dat verschilt van Qwens gehoste LiveTranslate-API, die 60 talen begrijpt maar in 29 talen spraak uitvoert. LiveTranslate richt zich op realtimegesprekken; Index-Translate maakt vooral tekstmodellen beschikbaar om zelf te draaien. Voor een organisatie hangt de inzet daarom af van de gewenste taalrichting, de taak en de beschikbare rekenkracht, niet alleen van het maximum van 150 talen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Vertaling die in je proces past

Ik denk mee over de juiste inzet, ontwerp de oplossing en bouw die end-to-end tot werkende software en automatisering. Waar het kan, draait die op je eigen infrastructuur.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens
Nieuws
5 min

27 aug 02:22

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens

Alibaba zet de gewichten van Qwen3.8-Flash-Next open. Het model activeert 6 van 176 miljard parameters per token, kost gehost 0,16 dollar per miljoen invoertokens en komt met een strakkere licentie dan het vlaggenschip.

Qwen3.8-27B evenaart GPT-5.6 Luna in onafhankelijke meting
Nieuws
5 min

18 aug 06:23

Qwen3.8-27B evenaart GPT-5.6 Luna in onafhankelijke meting

Benchmarkbureau Artificial Analysis geeft Qwen3.8-27B een 52, gelijk aan GPT-5.6 Luna. Het model past in 17 GB op een enkele videokaart, maar verbruikt 160 miljoen tokens waar de mediaan op 43 miljoen ligt.

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld
Inzicht
7 min

15 aug 17:00

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld

Qwen, Kimi, Llama en Gemma zetten voorwaarden op je omzet, je gebruikersaantal en je merknaam. Een gratis model met een drempel is geen open source, maar een inkoopbeslissing die je vooruitschuift naar het moment dat je niet meer weg kunt.

Alibaba publiceert Qwen3.8-27B onder Apache 2.0, zonder omzetdrempel
Nieuws
5 min

14 aug 20:11

Alibaba publiceert Qwen3.8-27B onder Apache 2.0, zonder omzetdrempel

Alibaba zet de gewichten van Qwen3.8-27B onder Apache 2.0 op Hugging Face. Het formaat dat op één videokaart past valt daarmee buiten de licentie met de omzetdrempel van 50 miljoen dollar die het vlaggenschip wel draagt.

Qwen verlaagt API-prijzen voor Audio 3.1
Nieuws
3 min

23 sep 16:48

Qwen verlaagt API-prijzen voor Audio 3.1

Qwen vernieuwt drie Audio 3.1-modellen en voegt ASR-Next en TTS-Next toe. De korting loopt volgens het bedrijf op tot 95 procent, maar de prijsbasis en Europese beschikbaarheid vragen om context.

Qwen brengt Qwen-Image-2.1 uit als open-weight beeldmodel
Nieuws
3 min

20 sep 22:34

Qwen brengt Qwen-Image-2.1 uit als open-weight beeldmodel

Qwen-Image-2.1 maakt lokale beeldgeneratie en bewerking toegankelijk met 7 miljard parameters, 2K-uitvoer en transparante beelden. De researchlicentie laat commercieel gebruik pas toe na een aparte licentie van Qwen.