Microfoon met popfilter in een opnamestudio
Nieuws29 september · 06:562 min leestijd

ElevenLabs brengt v4 en v4 Turbo naar meer dan 90 talen

ElevenLabs brengt v4 en v4 Turbo uit voor meer dan 90 talen. De API-documentatie bevestigt stemklonen en verschillende routes voor realtime spraak, terwijl een bedrijfstest 150 milliseconden tot eerste audio meldt.

ElevenLabs bracht op 28 september v4 en v4 Turbo uit voor spraak in meer dan 90 talen; Turbo bereikt volgens het bedrijf mediaan 150 milliseconden tot de eerste hoorbare spraak.

Voor Nederlandse organisaties die klanten of medewerkers in meerdere talen bedienen, verandert de productie van gesproken content en spraakinterfaces. Dezelfde stem kan volgens ElevenLabs in andere taalversies spreken met behoud van de sprekeridentiteit. Turbo is bedoeld voor realtime gesprekken, naast het maken van audiocontent.

Eén stem over taalgrenzen

v4 geeft makers meer regie over de voordracht. Inline tags en gewone taal kunnen aangeven hoe een zin moet klinken, welke emotie past of welk geluid moet meekomen. De modellen houden volgens de aankondiging de stemidentiteit beter vast in lange teksten en gesprekken met meerdere sprekers.

Ook stemklonen horen bij de release. TechCrunch meldt dat een Instant Voice Clone met slechts tien seconden audio kan worden gemaakt. Dat verlaagt de hoeveelheid bronmateriaal voor een eerste proef met een eigen stem.

De modelkeuze zit ook in de API

De modeldocumentatie noemt v4 en v4 Turbo als API-modellen voor meer dan 90 talen en hoogwaardige stemklonen. v4 is beschikbaar via Text to Dialogue; Turbo gebruikt de WebSocket-route voor realtime audio. De API-referentie beschrijft het maken en streamen van dialogen. Een aparte API-route maakt Instant Voice Clones aan.

Voor lange teksten geldt een concrete grens: v4 verwerkt maximaal 10.000 tekens per aanvraag, volgens de documentatie ongeveer tien minuten audio. Een audioboek of cursus moet dus in meerdere delen worden gegenereerd.

ElevenLabs mat in september een mediane tijd van aanvraag tot hoorbare spraak van 150 milliseconden voor v4 Turbo. In dezelfde test kwamen vier andere modellen uit op 262 tot 814 milliseconden. Het bedrijf gebruikte gelijke scripts en standaardinstellingen en haalde netwerkvertraging uit de meting. De uitkomst beschrijft dus de modeltest, niet de totale wachttijd van een complete bedrijfsapplicatie.

De grafiek van ElevenLabs vergelijkt de mediane tijd tot eerste spraak van v4 Turbo met vier andere modellen. Bron: ElevenLabs
De grafiek van ElevenLabs vergelijkt de mediane tijd tot eerste spraak van v4 Turbo met vier andere modellen. Bron: ElevenLabs

Taalbereik, herkenbare stem en responstijd komen zo samen in één programmeerbare spraaklaag. Die kan terugkeren in productuitleg, trainingen en live klantcontact, met dezelfde stem over verschillende taalversies heen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van tekst naar spraak

Ik denk mee over de rol van spraak in je klantproces, ontwerp de oplossing en realiseer die van eerste idee tot live product. Waar het kan, bouw ik self-hosted en neem ik koppelingen en automatisering mee.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

AISI meet supplychain-aanvallen door Astra in simulaties
Nieuws
2 min

28 sep 22:50

AISI meet supplychain-aanvallen door Astra in simulaties

Het Britse AI Security Institute zag GPT-6 Astra in 29,2% van gesimuleerde cybertrajecten een supplychain-aanval afronden. De cyberclassifiers stonden uit en echte systemen waren niet bereikbaar.

Google migreert Gemini Gems automatisch naar Skills
Nieuws
3 min

28 sep 22:45

Google migreert Gemini Gems automatisch naar Skills

Google migreert Gemini Gems automatisch naar Skills, maar niet elke accountgroep op dezelfde datum. Persoonlijke accounts volgen in november, Workspace-bedrijven in maart 2027. Ondersteunde kennisbestanden gaan mee, al werken enkele Gem-hulpmiddelen nog niet in Skills.

Anthropic claimt tot 30% lagere taakkosten met Sonnet 5.5
Nieuws
2 minBijgewerkt om 04:28

28 sep 22:23

Anthropic claimt tot 30% lagere taakkosten met Sonnet 5.5

Claude Sonnet 5.5 kost volgens Anthropic tot 30 procent minder per typische taak dan Sonnet 5, terwijl de input- en outputtarieven gelijk blijven. De besparing komt volgens het bedrijf uit lager tokenverbruik.

Meta kondigt Enterprise Platform voor zakelijke AI aan
Nieuws
4 min

28 sep 16:39

Meta kondigt Enterprise Platform voor zakelijke AI aan

Meta wil Muse, Meta Business Agent, Muse API en Muse Code als zakelijke diensten aanbieden. Voor het Enterprise Platform ontbreken nog prijs en startdatum, terwijl de losse Model API wereldwijd beschikbaar is.

NVIDIA lanceert platform voor agentbeveiliging
Nieuws
2 minBijgewerkt om 07:00

28 sep 12:38

NVIDIA lanceert platform voor agentbeveiliging

NVIDIA brengt OpenShell breed beschikbaar als beveiligingsgrens voor AI-agents en presenteert Sentry als referentieontwerp op BlueField-4. De twee onderdelen hebben daarmee een verschillende beschikbaarheidsstatus voor organisaties.

Exa lanceert Agent Ultra voor diepgaand AI-onderzoek
Nieuws
2 min

26 sep 12:42

Exa lanceert Agent Ultra voor diepgaand AI-onderzoek

Exa Agent Ultra verdeelt omvangrijk webonderzoek over meerdere AI-agenten. De API richt zich op marktmapping, KYC en prospectlijsten met bronverwijzingen; complexe runs duren volgens Exa meestal 30 minuten en kunnen tot drie uur lopen.