Kostenloses Tool|Automatische Video-Untertitel

Untertitel für dein Video
Wort für Wort, automatisch

Video hochladen und wortgenau getimte Untertitel zurückbekommen - in dem Stil, den Short-Form-Accounts wirklich benutzen. Nichts tippen, nichts auf einer Timeline verschieben.

So funktioniert es

Drei Schritte, zwei davon unsere

Von der Datei auf deinem Rechner zum fertigen Video.

01

Video hochladen

Jedes Video, das du schon hast: Talking Head, Podcast-Ausschnitt, Voice-over. Die Sprache wird von selbst erkannt, du musst nichts angeben.

02

Whisper timet jedes Wort

Kein Textblock pro Satz, sondern Anfang und Ende für jedes einzelne Wort. Genau das lässt den Untertitel auf der Silbe landen statt eine Sekunde zu spät.

03

Stil wählen und exportieren

Elf fertige Stile, vom ruhigen Broadcast-Untertitel bis zum hüpfenden Highlight. Im Editor änderst du, was du willst, dann rendern.

Funktionen

Was du bekommst

Die Details, die echte Untertitel von automatischen unterscheiden.

Wortgenaues Timing

Jedes Wort hat seinen eigenen Anfang und sein eigenes Ende, das Highlight folgt der Stimme exakt. Timing pro Satz ist der Grund, warum die meisten Auto-Untertitel verschoben wirken.

Elf Stile, kein Design nötig

Jedes Preset setzt Schrift, Kontur, Akzentfarbe und Animation in einem. Du wählst eins und siehst schon aus wie die Accounts, gegen die du postest.

Die KI wählt die Betonung

Ein zweiter Durchgang liest das Transkript und markiert die bedeutungstragenden Wörter. Die bekommen Akzentfarbe und Pop, Füllwörter bleiben ruhig.

Zwei Personen, zwei Farben

Sprechererkennung an, und ein Interview kommt mit einer Farbe pro Stimme zurück: Zuschauer sehen, wer spricht, ohne es zu hören.

Ein Wort einmal korrigieren

Ein falsch verstandener Name wird an einer Stelle korrigiert und überall aktualisiert, statt in neun einzelnen Untertiteln.

Hoch- oder Querformat

9:16 für TikTok, Reels und Shorts, 16:9 für YouTube. Die Untertitel werden für das gewählte Format gesetzt, nicht nachträglich hineingequetscht.

FAQ

Fragen, die wirklich gestellt werden

Whisper beherrscht rund hundert und erkennt selbst, welche es hört - du wählst sie nicht vorher. Akzente und Sprachwechsel sind kein Problem; erst bei sehr verrauschtem Ton fängt jedes Modell an zu raten.

Die Transkription nimmt Dateien bis 25 MB, also ein paar Minuten eines normalen Clips. Ist es länger, schneide es in Teile - im Editor setzt du sie wieder zu einer Timeline zusammen.

Ja, alles: die Wörter selbst, die Zeilenumbrüche, wie viele Wörter gleichzeitig stehen, Position, Farben, welche Wörter betont sind. Die Generierung ist ein Startpunkt, kein festes Ergebnis.

Nein. Die Untertitel werden ins Video gerendert, und genau das brauchen Short-Form-Plattformen: eine separate Untertiteldatei wird in den Feeds von TikTok, Reels und Shorts ignoriert.

Ja. Reine Musikpassagen werden als solche erkannt und bleiben ohne Text, statt zu Unsinn transkribiert zu werden; die Sprache drumherum behält ihr Timing.

Ein Video anzulegen und zu untertiteln ist kostenlos; nur der finale Render verbraucht Credits, und ein kostenloses Konto bekommt welche zum Ausprobieren. Die Kosten stehen vor dem Start da.

Dein Video hat die Worte schon

Es fehlen die achtzig Prozent Zuschauer, die ohne Ton schauen.

Video untertiteln