Daj wideo głos
i ścieżkę dźwiękową, z jednego klucza
Jedno wywołanie wypowiada linijkę z twojej osi czasu i wraca wyrównane słowo po słowie przez Whisper, więc napisy trafiają w sylabę. Drugie pisze piosenkę pod spodem. Czterej dostawcy głosu, po jednym endpoincie.
POSThttps://autostud.ai/api/v1/actions/timeline.generate_audioTrzy wywołania, od ciszy do ścieżki dźwiękowej
Udźwiękowij blok, dodaj piosenkę jeśli chcesz, a potem wyrenderuj całość.
- 1
Udźwiękowij blok
Skieruj wywołanie na blok osi czasu i wybrany głos. Wraca audio, jego dokładna długość i czasy Whispera słowo po słowie, dzięki którym napisy trafiają w sylabę.
export AUTOSTUD_API_KEY="sk_live_xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx" curl -X POST https://autostud.ai/api/v1/actions/timeline.generate_audio \ -H "Authorization: Bearer $AUTOSTUD_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "video_id": "0f4c8b71-2d95-47a3-9e6c-15b8ad7f3c20", "block_id": "block_2", "voice_settings": { "voice_provider": "elevenlabs", "voice_id": "rachel", "playback_speed": 1 } }' - 2
Napisz piosenkę
Brief, styl albo twój własny tekst. Muzyka jest asynchroniczna: wywołanie zwraca zadanie, a music.completed przynosi zhostowane ścieżki.
curl -X POST https://autostud.ai/api/v1/actions/music.generate \ -H "Authorization: Bearer $AUTOSTUD_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "title": "Lighthouse", "style": "warm lo-fi, slow, no drums", "prompt": "A calm bed under a voice-over about the sea", "instrumental": true }' # Already wrote the words? Send lyrics instead of prompt. - 3
Wyrenderuj to razem
Audio decyduje o długości bloku, więc gdy głos już jest, renders.create zamienia oś czasu w mp4 z całą synchronizacją na miejscu.
curl -X POST https://autostud.ai/api/v1/webhooks \ -H "Authorization: Bearer $AUTOSTUD_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "url": "https://your-app.com/hooks/autostud", "events": ["music.completed", "music.failed"], "description": "Audio" }'
Co możesz przekazać
Trzy pola, by wypowiedzieć blok, jedno, by zamówić piosenkę.
video_idWideo, którego oś czasu zawiera udźwiękawiany blok.
block_idKtóry blok dostaje głos. Jego długość idzie za audio, a nie odwrotnie.
voice_settingsSam głos: dostawca, referencja głosu, tempo. Z własnym kluczem dostawcy generowanie nic nie kosztuje.
promptDla music.generate: brief piosenki. Wyślij zamiast tego lyrics, jeśli tekst już masz.
Czterej dostawcy, jeden kształt wywołania
Głosy to katalog, nie lista wpisana na sztywno. Przynieś swój klucz dostawcy, a generacje są darmowe; użyj naszego, a rozliczymy je w kredytach jak wszystko inne.
Piosenki zgłaszają się same
Mowa wraca w odpowiedzi. Piosenka trwa dłużej, więc wyzwala zdarzenie: zarejestruj webhook raz, a ścieżki przyjdą zhostowane, z już rozliczonymi kredytami.
generation.completedmusic.completedmusic.failedO co programiści pytają najpierw
Czy dostanę czasy na poziomie słów?
Tak. Wyrównanie Whispera działa na tym, co dopiero powstało, więc odpowiedź niesie czasy per słowo w pełnej precyzji, nigdy zaokrąglone do sekundy.
Czy mogę użyć własnego klucza ElevenLabs?
Tak i o to właśnie chodzi w trybie podwójnym: z twoim kluczem generowanie kosztuje zero kredytów, a audio i tak jest hostowane, wyrównane i położone na bloku.
Ile trwa piosenka?
Minuty, nie milisekundy, i dlatego muzyka jest asynchroniczna. Odczytaj ją przez music.get_task, jeśli webhook nie wchodzi u ciebie w grę.
Co dzieje się z długością bloku?
Decyduje o niej audio. Blok trwa dokładnie tyle, co mowa w środku plus skonfigurowane przerwy, więc nie trzeba niczego dostrajać ręcznie po fakcie.
Co możesz wywołać
Napisy słowo po słowie z synchronizacją Whisper, podkreśleniami AI i 116 stylami.
Przeczytaj przewodnikZleć render, odbierz webhook zamiast odpytywać i pobierz mp4.
Przeczytaj przewodnikTekst na wideo, sceny faceless i wydłużanie ujęć prosto z Twojego backendu.
Przeczytaj przewodnikGeneruj, zmieniaj styl, kadruj i usuwaj tło na dużą skalę.
Przeczytaj przewodnikZaplanuj gotowe wideo i odczytaj kalendarz.
Przeczytaj przewodnikGotowy do tworzenia?
Zacznij generować wiralowe filmy w kilka minut. Karta kredytowa nie jest wymagana do bezpłatnej wersji próbnej.