Een klantcontactmedewerker met headset, met twee collega’s achter hem.
Nieuws2 oktober · 04:272 min leestijd

Microsoft lanceert streamingtranscriptie en twee spraakmodellen

Microsoft lanceert live transcriptie en twee spraakmodellen voor AI-stemagenten. Tekst verschijnt terwijl iemand nog praat; de nieuwe spraakmodellen kunnen Nederlands spreken en zijn via Microsoft Foundry beschikbaar.

Microsoft lanceert op 1 oktober MAI-Transcribe-2-Streaming, MAI-Voice-2.1 en MAI-Voice-2.1-Flash als bouwstenen voor stemagenten, zodat software spraak live kan verwerken en meertalig kan terugspreken.

Voor Nederlandse klantcontactteams verschuift spraak-AI van nabewerking naar het gesprek zelf: een agent kan een vraag herkennen en een volgende systeemstap voorbereiden voordat de beller klaar is. De eerdere MAI-Transcribe-2 verwerkt opgenomen audio voor 10 dollarcent per uur en biedt geen streamingfunctie. De livevariant kost 54 dollarcent per audio-uur tot eind 2026; alle drie modellen zijn beschikbaar via Microsoft Foundry en Azure Speech. Dat is 5,4 keer de introductieprijs van de opgenomen-audioversie.

Luisteren terwijl de klant praat

Het model toont de eerste tekst iets meer dan 100 milliseconden nadat audio binnenkomt. Naarmate er meer spraak volgt, kan het die tekst bijwerken en een stabiele versie vastleggen zodra de spreker klaar is. Daardoor kan een stemagent al redeneren of een systeemfunctie aanroepen terwijl de klant nog praat.

Dat verandert de rol van transcriptie. Die hoeft niet meer alleen achteraf een gesprek uit te schrijven, maar kan tijdens het contact tijd geven om gegevens op te halen of een antwoord voor te bereiden. De actie zelf hangt nog af van een koppeling met je klant-, order- of ticketsysteem.

De antwoordstem spreekt Nederlands

MAI-Voice-2.1 en Flash zetten tekst om in spraak in 23 talen en kunnen dezelfde herkenbare stem over talen heen behouden. Microsoft noemt Nederlands en vermeldt $22 per miljoen tekens voor Voice-2.1, $15 voor Flash en ongeveer 45 milliseconden modelinference voor Flash. Dat laatste cijfer meet de modelinference, niet de totale tijd van een klantvraag tot een antwoord.

De aankondiging noemt 60 talen met doorlopende automatische taaldetectie voor streamingtranscriptie, maar somt ze niet per taal op. De Nederlandse spraakuitvoer bevestigt dus niet automatisch dat de transcriptiemodule Nederlands herkent. Beide spraakmodellen kunnen ook een stem nabootsen op basis van enkele seconden voorbeeldgeluid, met ingebouwde toestemmingswaarborgen.

Beschikbaar via Azure

Naast Microsoft Foundry en Azure Speech noemt Microsoft de MAI Playground, Vercel en Azure Voice Live als toegangsroutes. De spraakmodellen zijn ook via OpenRouter beschikbaar; LiveKit volgt later. Microsoft Learn markeert Voice-2.1 en Flash als publieke preview zonder SLA en raadt productiegebruik af.

De nieuwe modellen leveren de timing en de stem. Of de klant daarmee ook geholpen wordt, hangt af van de gegevens en systeemkoppelingen achter de agent.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van gesprek naar automatisering

Ik denk mee over hoe een AI-stemagent in je klantproces past en ontwerp en bouw daarna de koppelingen en automatisering end-to-end, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Docusign verwerkt dagelijks ruim een miljoen overeenkomsten met taakgerichte AI-modellen
Nieuws
4 min

16 sep 04:28

Docusign verwerkt dagelijks ruim een miljoen overeenkomsten met taakgerichte AI-modellen

Docusign verlaagt AI-verwerkingskosten met 90 procent en verhoogt documentdoorvoer tot achtvoudig door taakgerichte modellen op Azure. De klantcase laat zien waarom context, modelkeuze en documentarchitectuur samen de zakelijke rekensom bepalen.

GitLab koppelt Duo Self-Hosted aan Microsoft Foundry
Nieuws
4 min

8 sep 20:29

GitLab koppelt Duo Self-Hosted aan Microsoft Foundry

GitLab Duo Self-Hosted kan nu modellen uit Microsoft Foundry gebruiken. GPT, Claude, Llama en Mistral zijn per functie te koppelen, maar modelondersteuning, licenties, regio’s en datastromen bepalen welke opzet werkelijk werkt.

OpenAI publiceert promptgids voor GPT-6 Astra met blokkeerlijst
Nieuws
5 min

5 sep 16:20

OpenAI publiceert promptgids voor GPT-6 Astra met blokkeerlijst

OpenAI's promptgids voor GPT-6 Astra bevat een blokkeerlijst van slop-woorden, kant-en-klare instructies tegen onnodig doorvragen en een reeks API-parameters die vervallen. Wat teams die net overstapten concreet moeten herschrijven.

Microsoft brengt GPT-6 Astra naar Foundry zonder EU-datazone
Nieuws
4 min

4 sep 20:34

Microsoft brengt GPT-6 Astra naar Foundry zonder EU-datazone

GPT-6 Astra is sinds 3 september af te nemen in Microsoft Foundry, maar alleen via het programma met beperkte toegang en zonder EU-datazone. Global-verwerking kan in elke Azure-regio plaatsvinden, de Amerikaanse zone kost 10 procent meer.

Meta koopt voor honderden miljoenen per jaar AI-modellen bij Microsoft
Nieuws
4 min

22 aug 08:09

Meta koopt voor honderden miljoenen per jaar AI-modellen bij Microsoft

Meta blijkt een van Microsofts grootste AI-klanten: honderden miljoenen dollars per jaar voor modeltoegang via Foundry, met wekelijks biljoenen tokens. Zelfs een bedrijf met eigen frontiermodellen koopt capaciteit bij een concurrent.

Microsoft en Databricks verlengen samenwerking tot in de jaren 2030
Nieuws
4 min

23 jul 20:12

Microsoft en Databricks verlengen samenwerking tot in de jaren 2030

Microsoft en Databricks verlengen hun samenwerking tot in de jaren 2030 en brengen Databricks' tools Genie en Unity AI Gateway dieper in Microsoft 365, Teams en Copilot. Wat dat betekent voor bedrijven op de Azure-stack.