Videomaker met bril en koptelefoon bewerkt beeld in Adobe Premiere Pro op een iMac.
Nieuws20 augustus · 22:245 min leestijd

Adobe zet AI-muziek, stem en geluidseffecten in Firefly algemeen beschikbaar

Adobe's drie AI-audiotools in Firefly zijn uit bèta: muziek, voice-over en geluidseffecten, ook in het Nederlands. De belofte commercieel veilig geldt breed, de juridische vrijwaring alleen op zakelijke plannen.

Adobe stelt de drie AI-audiotools in Firefly algemeen beschikbaar, meldt het bedrijf: Generate Music, Generate Speech en Generate Sound Effects verlaten de bèta en leveren audio die je commercieel mag gebruiken.

Voor een marketing- of contentteam verschuift daarmee een vaste kostenpost. Muziek, voice-over en geluidseffecten kwamen tot nu toe uit stockbibliotheken, elk met een eigen licentie en eigen zoekwerk. Ze zitten nu in dezelfde browsertool waar het beeld al vandaan komt, en het Firefly Speech-model spreekt ook Nederlands, dus een Nederlandse voice-over hoeft de deur niet meer uit. De belofte "commercieel veilig" heeft wel een grens, en die ligt niet in de tool maar in je abonnement.

Generate Music in Adobe Firefly, waar je de stijl van een track als losse trefwoorden in de prompt zet. (Bron: Adobe)
Generate Music in Adobe Firefly, waar je de stijl van een track als losse trefwoorden in de prompt zet. (Bron: Adobe)

De drie tools en wat ze maken

Elke tool draait op een eigen Adobe-model. Generate Music komt uit het Firefly Music Model en maakt volgens Adobe originele tracks die zijn afgestemd op de lengte en de sfeer van je video, zodat je content geen takedown riskeert. Adobe geeft je daarbij elke duur tussen vijf seconden en vijf minuten, royaltyvrij, met Content Credentials op het bestand. Zang en songwriting vallen erbuiten: het model mikt op instrumentale achtergrondmuziek.

Generate Speech zet een script om in een voice-over met sturing op stem, tempo en emotie. In de zijbalk kies je eerst het model, daarna de spreker: Adobe's commercieel veilige Firefly of het partnermodel ElevenLabs Multilingual v2, gevolgd door een lijst van 45 stemmen die zijn ingedeeld naar leeftijd en stemtype. Het Firefly Speech-model dekt twaalf taal- en accentcombinaties, waaronder Nederlands (nl-NL), naast Duits, Italiaans, Hindi, Mandarijn, twee Engelse en twee Franse accenten en drie Spaanse varianten.

Generate Sound Effects komt uit het Firefly Audio Model en maakt effecten die aansluiten op de actie en de timing in je beeld. Je stuurt het met een prompt, of met je eigen stem als voorbeeld. Adobe stelt dat de audio uit Firefly productieklaar en commercieel veilig is, zonder aparte abonnementen voor de tracks die je maakt.

Waar "commercieel veilig" ophoudt

De belofte rust op de trainingsdata. Adobe traint Firefly op gelicentieerde content zoals Adobe Stock plus publiek domein waarvan het auteursrecht is verlopen, en biedt IP-vrijwaring alleen aan klanten op kwalificerende plannen. Dat is een ander vertrekpunt dan generatoren die het open web hebben afgegraasd, en het verklaart waarom Adobe de term "commercieel veilig" zo consequent gebruikt.

Die vrijwaring is precies het punt waar de belofte dunner wordt. Ze zit niet in een gewoon abonnement: Adobe verkoopt hem als losse aanspraak aan zakelijke klanten, via een Adobe Express and Firefly site license of via bepaalde Creative Cloud for enterprise-plannen. Een zzp'er of klein team op een standaard Firefly-plan krijgt dus wel de garantie over de trainingsdata, maar geen contractueel vangnet als er ooit een claim binnenkomt. Dat onderscheid is bekend terrein bij AI-beeld, waar Firefly vrijwaring alleen op de zakelijke plannen geeft en Midjourney en OpenAI hun output zonder vrijwaring "as is" leveren.

Wat het kost in credits

De drie audiotools vallen bij Adobe in de premiumcategorie, die generatieve credits verbruikt in plaats van onder onbeperkt standaardgebruik te vallen. De tarieven liggen vast: een geluidseffect kost 10 credits per generatie, spraak 10 credits per 1.000 tekens met het Firefly Speech-model en 15 credits per 1.000 tekens met ElevenLabs Multilingual v2.

Reken het door voor gewoon bedrijfswerk. Een voice-overscript van 3.000 tekens, ruwweg twee minuten spraak, kost 30 credits met Adobe's eigen stem en 45 met ElevenLabs. Op Firefly Pro for teams, dat 4.000 credits per maand geeft en tot 400 geluidseffecten, verdwijnt dat in de ruis; de zwaardere teamplannen gaan naar 10.000 en 50.000 credits per maand. Video blijft de post die een creditbudget leegtrekt, want gegenereerd beeld in 1080p rekent af per seconde. Audio rekent af per generatie of per duizend tekens, en dat is een orde van grootte goedkoper. Met een gratis Adobe-account krijg je dagelijks een beperkt aantal generaties om het te proberen.

Meer modelkeuze in dezelfde tool

Tegelijk voegde Adobe Gemini Omni Flash toe aan Firefly, naast bestaande modellen van Google, Kling AI, Luma AI, OpenAI en Runway. Dat model is op multimodaal werk gericht en niet specifiek op audio: je prompt mag video, audio en beeld bevatten naast tekst. Het onderscheid is de moeite van het onthouden waard, want partnermodellen vallen niet alleen in de duurdere creditklasse, ze vallen ook buiten de commercieel-veilige claim, die op Adobe's eigen Firefly-modellen slaat. Kies je in de stemkiezer ElevenLabs, dan kies je dus ook een ander juridisch profiel.

Waarom Adobe dit nu breed uitrolt

De praktijk liep voor op het productaanbod. In een onderzoek van Berklee College of Music onder 1.003 videomakers, muzikanten en marketeers, uitgevoerd met steun van Adobe maar zonder Adobe-invloed op werving of analyse, zegt 32,7 procent AI-muziek al te hebben gebruikt als definitieve audiotrack in gepubliceerd werk. Muziek is voor deze groep geen randzaak: iedere respondent gebruikt muziek in video's.

Daarmee tekenen zich twee routes af in AI-audio. Suno regelt herkomst achteraf en markeert alle gegenereerde muziek met een audiowatermerk terwijl commerciële rechten aan het abonnement hangen waaronder een track is gemaakt. Adobe pakt het aan de voorkant: gelicentieerde trainingsdata, herkomstmetadata in het bestand en een contract dat het restrisico afdekt, maar dan alleen voor wie daar apart voor betaalt.

De vraag bij een audiogenerator gaat daarmee steeds minder over hoe het klinkt en steeds meer over wie de rekening draagt als iemand aanklopt. Adobe verkoopt die zekerheid nu als productkenmerk, in gradaties per plan. Wie AI-audio in klantwerk levert, koopt niet alleen een generator maar ook een positie in die aansprakelijkheidsketen, en het loont om te weten welke.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van losse tools naar keten

AI-audio is één stap in een contentproces dat bij de meeste teams nog uit losse tools en handwerk bestaat. Ik denk mee over hoe die keten eruit moet zien, ontwerp hem en bouw en automatiseer hem daarna ook, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

AI-gegenereerde beelden legaal gebruiken in je marketing: licenties, auteursrecht en veilige bronnen
Gids
8 min

25 jun 15:01

AI-gegenereerde beelden legaal gebruiken in je marketing: licenties, auteursrecht en veilige bronnen

AI-beeld heb je zo gegenereerd, maar mag je het publiceren en is het van jou? Een praktische gids langs Midjourney, DALL-E en Firefly: licenties, auteursrecht, veilige bronnen en de afspraken die je bij klantwerk vastlegt.

Google laat je het zichtbare Gemini-watermerk uitzetten, SynthID blijft
Nieuws
4 min

14 aug 20:33

Google laat je het zichtbare Gemini-watermerk uitzetten, SynthID blijft

Google laat gebruikers het zichtbare watermerk op AI-beeld, video en muziek uit Gemini en Flow uitzetten. SynthID en C2PA blijven wel in de bestanden zitten, en jouw eigen meldplicht verandert er niets door.

Anthropic watermerkt alle tekst van Claude, wereldwijd
Nieuws
5 min

11 aug 02:10

Anthropic watermerkt alle tekst van Claude, wereldwijd

Anthropic weeft een onzichtbaar watermerk in alle tekst die Claude genereert, wereldwijd en op modelniveau, vanaf modellen van na 2 augustus 2026. Dat verandert de herkomst van je output, niet je eigen meldplicht als ondernemer.

Retailers halen AI-winkelverkeer binnen maar houden het afrekenen op hun eigen site
Nieuws
5 min

7 aug 14:23

Retailers halen AI-winkelverkeer binnen maar houden het afrekenen op hun eigen site

Walmart, Ulta Beauty en Wayfair passen hun sites aan voor ChatGPT en Gemini, maar willen dat klanten op hun eigen site afrekenen. De inzet is niet de order maar de klantdata eromheen.

Duitse rechter wijst fair use af en veroordeelt AI-muziekgenerator Suno
Nieuws
5 min

1 aug 14:11

Duitse rechter wijst fair use af en veroordeelt AI-muziekgenerator Suno

Het Landgericht München I veroordeelt AI-muziekgenerator Suno en wijst zowel de Europese datamining-uitzondering als de Amerikaanse fair use-verdediging af. De rechter stelt vast dat zes nummers reproduceerbaar in het model zijn opgeslagen.

Google lanceert Gemini 3.1 Flash-Lite en Omni Flash: beeldgeneratie in 4 seconden en video-AI via de API
Nieuws
4 min

30 jun 20:11

Google lanceert Gemini 3.1 Flash-Lite en Omni Flash: beeldgeneratie in 4 seconden en video-AI via de API

Google maakt hoge-volume beeldgeneratie en gespreksgestuurde videoproductie betaalbaar: Nano Banana 2 Lite genereert beelden in 4 seconden voor $0,034, Gemini Omni Flash maakt video bewerken via een tekstinstructie mogelijk voor $0,10 per seconde.