Bronnen
Maak ’m van jou
Geïnspireerd door dit verhaal? Maak van het idee in seconden je eigen AI-kunst — gratis beginnen, geen kaart nodig.
Gratis aan de slag
Elias legt het onderzoek achter de koppen uit in gewone taal.
Geïnspireerd door dit verhaal? Maak van het idee in seconden je eigen AI-kunst — gratis beginnen, geen kaart nodig.
Gratis aan de slagKies een companion en ontdek wat die van dit verhaal vindt
Suno, het AI-muziekplatform, heeft een publieke bètafunctie gelanceerd genaamd Speech die gesproken audio genereert uit een script of tekstbeschrijving en deze combineert met AI-gecomponeerde achtergrondmuziek — waardoor wat vroeger een workflow met twee tools was, wordt samengevouwen tot één enkele prompt.
Suno Speech accepteert twee soorten invoer: een direct script (woorden die je wilt laten uitspreken) of een beschrijvende prompt ("een kalme verteller die een nachtelijke hemel uitlegt"). Het model genereert vervolgens een stem die past en componeert tegelijkertijd instrumentale muziek om eronder te plaatsen. Volgens The Verge worden de twee audiolagen samen gegenereerd in plaats van achteraf aan elkaar genaaid — wat betekent dat de muziektiming en -dynamiek vanaf het begin rond de spraak worden gevormd, niet er later aan vastgeplakt.
Dat onderscheid is belangrijk voor iedereen die tijd heeft besteed aan het handmatig synchroniseren van narratie met een apart gegenereerd muziekbed. De gebruikelijke wrijving — tempo aanpassen, stiltes wegknippen, fade-ins bijstellen — verdwijnt wanneer beide elementen een enkele generatieslag delen.

Suno's Speech-functie genereert gesproken audio en achtergrondmuziek uit één enkele tekstprompt, hier getoond in voorbeelduitvoer van de publieke bèta.
Afbeelding: The Verge / The Verge AI
Stemstijl in Suno Speech wordt gestuurd door prompts, volgens dezelfde logica als de muziekmodus van het platform. Het beschrijven van "een schorre, langzame verteller" of "een opgewekte podcasthost" vormt de uitvoer op dezelfde manier als het specificeren van "lo-fi hip-hop met een melancholische piano" een muziektrack vormt. Er is geen stemkloning uit een geüploade sample in de huidige bèta — de stemmen worden vers gegenereerd uit de beschrijving, wat de functie weghoudt van het juridisch meer problematische gebied dat stemkloningstools bezetten.
Voor makers die AI-karakters of vertelde scènes bouwen, is dit een betekenisvol startpunt: je kunt itereren op vocale persoonlijkheid alleen door tekst, zonder referentieaudio op te nemen of een specifieke stem te licentiëren. De afweging is minder precieze controle vergeleken met toegewijde tekst-naar-spraakplatforms — Hugging Face's open TTS leaderboard benchmarkt verschillende alternatieven als fijnmazige stemkwaliteit de prioriteit is.

Suno's Speech-interface laat gebruikers een script of promptbeschrijving invoeren om een gesproken track te genereren met gelijktijdige achtergrondmuziek.
Afbeelding: The Verge / The Verge AI
De meest directe use case is korte video-narratie — het soort 30-tot-90-seconden audiobed dat makers momenteel samenstellen door muziek te genereren in Suno (of een concurrent), spraak te genereren in een apart TTS-tool, en beide vervolgens te bewerken in een DAW of video-editor. Suno Speech comprimeert dat tot één stap.
Suno's eigen framing, zoals gerapporteerd door The Verge, is voorzichtig: "Muziek zal altijd de kern blijven van wat we doen" — wat signaleert dat Speech een uitbreiding is van het muziekproduct, niet een herpositionering richting algemene stem-AI. Die framing suggereert ook dat de functie zal worden afgestemd op muzikale contexten (intro's, vertelde tracks, gesproken-woord liedjes) in plaats van langdurige audioboek- of podcastproductie.
Voor AI-beeld- en videomakers die Suno al gebruiken voor achtergrondaudio, elimineert de toevoeging van gesynchroniseerde narratie nog een externe afhankelijkheid. Een maker die een AI-vertelde slideshow of geanimeerde korte film bouwt, heeft nu een plausibele single-platform audiopijplijn — genereer de stem en muziek samen, exporteer, plaats in de video-editor.
De bèta is nu live op web en mobiel. Zoals bij de meeste Suno-bèta's zullen uitvoerkwaliteit en functieomvang waarschijnlijk verschuiven voor een volledige release — dus de huidige versie is het waard om te testen voor geschiktheid, maar nog niet om een productiepijplijn omheen te herbouwen.