從你手上的檔案,到可以直接發布的字幕影片。
你手上任何影片都可以:對鏡頭說話、Podcast 片段、旁白。語言會自動判斷,不需要事先指定。
不是每句一整塊文字,而是每個字都有自己的開始與結束。字幕因此落在音節上,而不是慢一秒才出現。
十一種現成樣式,從乾淨的字幕到會彈跳的重點字。在編輯器裡想改什麼都可以,然後算圖輸出。
真字幕和自動字幕的差別,就在這些細節。
每個字都有自己的開始和結束,所以高亮完全跟著聲音走。以句子為單位對齊,正是大多數自動字幕看起來會延遲的原因。
每個預設一次決定字體、外框、強調色和動畫。選好之後,你看起來就跟正在競爭的那些帳號一樣。
第二輪處理會讀過逐字稿,標出承載意思的字。那些字才拿到強調色和彈跳,連接詞則保持安靜。
打開講者辨識,訪談就會依聲音分成不同顏色。觀眾不用開聲音,也知道現在是誰在說話。
Whisper 聽錯的名字,改一個地方就會套用到所有出現的位置,不必逐一重寫九段字幕。
TikTok、Reels、Shorts 用 9:16,YouTube 用 16:9。字幕是照你選的比例擺放,不是事後硬塞進去。
Whisper 支援約一百種語言,而且會自己判斷聽到的是哪一種,不必事先選。口音和中英夾雜都處理得不錯;只有雜訊很重的音檔,才會讓任何模型開始用猜的。
轉寫這一步每個檔案最多 25 MB,一般片段大約是幾分鐘。更長的話請先切成幾段,編輯器可以把它們接回同一條時間軸。
全部都能改:文字本身、斷行位置、一次顯示幾個字、位置、顏色、哪些字要強調。生成只是起點,不是鎖死的結果。
不會。字幕是直接壓進影片裡的,這正是短影音平台需要的形式;獨立的字幕檔在 TikTok、Reels 和 Shorts 的動態牆上會被忽略。
可以。純音樂的片段會被辨識出來並留白,而不會被轉寫成亂七八糟的字,前後的說話內容也維持原本的對齊。
建立影片和加字幕都免費,只有最後算圖會消耗點數,免費帳號也有可以試用的額度。開始前就會看到會用掉多少。