Eén call spreekt een regel van je tijdlijn uit en komt woord voor woord uitgelijnd terug door Whisper, zodat ondertitels op de lettergreep landen. Een tweede schrijft het nummer eronder. Vier stemleveranciers, elk één endpoint.
POSThttps://autostud.ai/api/v1/actions/timeline.generate_audioGeef het blok een stem, voeg een nummer toe als je wilt, en render dan het geheel.
Richt de call op een blok van de tijdlijn en de stem die je wilt. Terug komen de audio, de exacte duur, en de Whisper-woordtimings die ondertitels op de lettergreep laten landen.
export AUTOSTUD_API_KEY="sk_live_xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx"
curl -X POST https://autostud.ai/api/v1/actions/timeline.generate_audio \
-H "Authorization: Bearer $AUTOSTUD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"video_id": "0f4c8b71-2d95-47a3-9e6c-15b8ad7f3c20",
"block_id": "block_2",
"voice_settings": {
"voice_provider": "elevenlabs",
"voice_id": "rachel",
"playback_speed": 1
}
}'Een briefing, een stijl of je eigen tekst. Muziek is asynchroon: de call geeft een taak terug en music.completed brengt de gehoste tracks.
curl -X POST https://autostud.ai/api/v1/actions/music.generate \
-H "Authorization: Bearer $AUTOSTUD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"title": "Lighthouse",
"style": "warm lo-fi, slow, no drums",
"prompt": "A calm bed under a voice-over about the sea",
"instrumental": true
}'
# Already wrote the words? Send lyrics instead of prompt.Audio bepaalt de lengte van een blok, dus zodra de stem erin zit maakt renders.create van de tijdlijn een mp4 met alles in sync.
curl -X POST https://autostud.ai/api/v1/webhooks \
-H "Authorization: Bearer $AUTOSTUD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"url": "https://your-app.com/hooks/autostud",
"events": ["music.completed", "music.failed"],
"description": "Audio"
}'Drie velden om een blok uit te spreken, één om een nummer te briefen.
video_idDe video waarvan de tijdlijn het blok bevat dat je inspreekt.
block_idWelk blok de stem krijgt. De duur volgt de audio, niet andersom.
voice_settingsDe stem zelf: leverancier, stemreferentie, snelheid. Met je eigen leverancierssleutel kost de generatie niets.
promptVoor music.generate: de briefing van het nummer. Stuur lyrics als je de tekst al hebt.
Stemmen zijn een catalogus, geen hardgecodeerde lijst. Neem je eigen leverancierssleutel mee en generaties zijn gratis; gebruik de onze en ze worden net als al het andere in credits afgerekend.
Spraak komt terug in het antwoord. Een nummer duurt langer en vuurt daarom een event: registreer één webhook en de tracks komen gehost binnen, met de credits al verrekend.
generation.completedmusic.completedmusic.failedJa. De Whisper-uitlijning draait op wat net is gegenereerd, dus het antwoord draagt woordtimings op volle precisie, nooit afgerond op de seconde.
Ja, en dat is precies het punt van de dubbele modus: met jouw sleutel kost de generatie nul credits, en de audio wordt alsnog gehost, uitgelijnd en op het blok gezet.
Minuten, geen milliseconden, en daarom is muziek asynchroon. Lees het terug met music.get_task als een webhook in jouw stack niet kan.
De audio bepaalt hem. Een blok duurt precies de spraak erin plus de ingestelde pauzes, dus er hoeft achteraf niets met de hand getimed te worden.
Woord-voor-woord ondertitels met Whisper-timing, AI-nadruk en 116 stijlen.
Lees de gidsZet een render in de wachtrij, neem de webhook in plaats van pollen, haal de mp4 op.
Lees de gidsTekst naar video, faceless scènes en clipverlenging vanuit je eigen backend.
Lees de gidsGenereren, restylen, bijsnijden en achtergronden wegknippen op schaal.
Lees de gidsPlan een afgeronde video in en lees de kalender terug.
Lees de gidsMaak virale video's in enkele minuten. Geen creditcard nodig voor de gratis proefperiode.