YouTube 逐字稿產生器中日英影片、錄音檔,一鍵轉成逐字稿
有字幕的影片,貼上轉錄稿就整理好;沒有字幕,就上傳音檔或影片檔,用 AI 語音辨識轉成文字。
還有逐句跟讀、聽寫模式,一鍵帶去 ChatGPT、Claude 做 AI 總結。
怎麼複製 YouTube 轉錄稿?
- 用電腦開啟 YouTube 影片,點影片說明欄的「…更多」。
- 拉到說明欄最下方,按「顯示轉錄稿」(Show transcript)。
- 右側出現轉錄稿後,從第一行拖曳選取到最後一行,按 Ctrl+C(Mac 是 ⌘+C)。
- 回到這裡貼上,按「整理成逐字稿」。
手機 YouTube App 多半沒辦法選取轉錄稿文字,建議用電腦操作。找不到「顯示轉錄稿」代表影片沒有字幕,可以改用上方的「上傳音檔」。
🔒 音檔只在你的瀏覽器裡辨識,不會上傳到任何伺服器。
還沒有收藏的句子,按每句右上角的 ☆ 就能收藏。
YouTube 影片怎麼轉成逐字稿?
快速答案:只要影片有字幕(包含 YouTube 自動產生的字幕),用電腦版 YouTube 就能免費取得逐字稿:
- 用電腦開啟影片,點說明欄的「…更多」。
- 按說明欄最下方的「顯示轉錄稿」,右側會出現含時間碼的轉錄稿。
- 從第一行選取到最後一行並複製。
- 貼到本頁工具按「整理成逐字稿」,時間碼與[音樂]標記會自動處理,並合併成段落。
影片沒有字幕?切到「上傳音檔」,選擇你手上的錄音檔或影片檔(MP3、M4A、WAV、MP4、MOV),工具會用 Whisper 語音辨識直接在瀏覽器裡轉成逐字稿,不會上傳檔案。
錄音檔、Podcast、課程影片轉逐字稿
上課錄音、會議錄音、Podcast 或自己拍的影片,都可以用「上傳音檔」轉成文字:
- 切到「上傳音檔」,選擇或拖曳檔案進來。
- 選模型:英文或很清楚的錄音選「快速」;中文、日文建議選「精準」。
- 按「開始轉成逐字稿」。第一次使用要下載辨識模型,之後就會存在瀏覽器裡。
- 完成後一樣可以閱讀、逐句跟讀(直接播放你的音檔),或交給 AI 做總結。
辨識速度看你的裝置:支援 WebGPU 的電腦(新版 Chrome、Edge、Safari)會自動用顯示卡加速,「快速」模型處理時間大約是音檔長度的幾分之一;不支援的裝置會改用 CPU,速度大約和音檔長度差不多。「精準」模型會再慢一些。語音辨識偶爾會聽錯人名、專有名詞,重要內容請再對照原音。
三種模式,看你想怎麼用逐字稿
用 YouTube 逐字稿學日文、英文的 4 個步驟
- 先不看字幕,完整聽一次影片,抓住大意。
- 切到「逐句跟讀」,按「▶ 播這句」,聽完一句就跟著唸,模仿語調和節奏(shadowing)。
- 打開「聽寫模式」,文字會被模糊遮住,聽完一句再點開對答案。
- 想記的句子按 ☆ 收藏,一鍵複製到筆記;或到「AI 總結」產生單字與文法筆記。
*「播這句」和自動標示目前句子的功能,需要在第 1 步填入影片網址。
YouTube 逐字稿常見問題
YouTube 影片可以免費轉成逐字稿嗎?
可以。只要影片有字幕(包含 YouTube 自動產生的字幕),電腦版 YouTube 就有「顯示轉錄稿」功能。把轉錄稿複製後貼進這個工具,就能免費整理成去掉時間碼、分好段落的逐字稿,不用註冊,也不用安裝外掛。
找不到「顯示轉錄稿」按鈕怎麼辦?
先確認是用電腦版瀏覽器,並展開影片說明欄(點「…更多」),按鈕通常在說明欄最下方。如果還是沒有,代表這支影片沒有任何字幕,可能是創作者關閉了字幕,或影片語言不支援自動字幕,這種情況如果你手上有影片或錄音檔,可以改用「上傳音檔」轉成逐字稿。
支援哪些語言?會幫我翻譯嗎?
目前針對中文、日文、英文最佳化,會自動判斷語言,也可以手動指定。工具不會翻譯:影片是什麼語言,整理出來就是什麼語言的逐字稿,適合拿來學原文。如果需要中文說明,可以在「AI 總結」選擇用繁體中文回覆。
自動字幕沒有標點符號,可以整理嗎?
可以。YouTube 自動產生的字幕常常沒有標點,工具會改以字幕行作為句子單位。想要通順的文章版本,到「AI 總結」選「補標點・分段」,把提示詞貼給 ChatGPT、Claude 或 Gemini,AI 會在不翻譯、不改原文的前提下補上標點並分段。
怎麼用逐字稿學日文、英文?
建議先不看字幕聽一次影片;接著切到「逐句跟讀」,按「播這句」聽完一句就跟著唸;再打開「聽寫模式」,聽完一句後點開文字對答案。想記的句子按星號收藏,最後一鍵複製收藏的句子做成筆記。
沒有字幕的影片或錄音檔,可以轉成逐字稿嗎?
可以。切到「上傳音檔」,選擇 MP3、M4A、WAV、MP4、MOV 等檔案,工具會用 OpenAI 開源的 Whisper 語音辨識模型,直接在你的瀏覽器裡轉成含時間碼的逐字稿,支援中文、日文、英文。第一次使用要下載模型(快速約 80–200MB、精準約 250–590MB,支援顯示卡加速的裝置會下載較大的版本),之後會存在瀏覽器裡。YouTube 影片本身沒辦法直接下載音訊,需要是你手上已經有的檔案。
貼上的內容或上傳的音檔會被傳到伺服器嗎?
不會。逐字稿的整理和語音辨識都在你的瀏覽器裡完成,音檔不會上傳;只有辨識模型會從網路下載到你的裝置。最近一次的逐字稿文字只會存在你這台裝置的瀏覽器,方便下次回來繼續。使用 AI 總結時,只有你自己把提示詞貼到 AI 服務,內容才會送到那個服務。
可以匯入 SRT 或 VTT 字幕檔嗎?
可以。按「匯入字幕檔」選擇 .srt、.vtt 或 .txt,工具會讀取時間碼與文字,自動去除重複的滾動字幕行,整理方式和貼上轉錄稿相同。
