文件 工具
音訊和視訊轉文字轉錄器
選擇音訊或視訊文件,即可在本地建立文字轉錄稿,無需上傳錄音。
在瀏覽器中處理,不會上傳。
對於較長或高解析度的媒體文件,建議使用桌上型電腦或筆記型電腦。請保持此標籤頁開啟;速度、記憶體和電池續航時間取決於您的裝置。
首次使用會下載約 58 MB 的型號和本地引擎資訊。您的錄音尚未上傳;如果清除瀏覽器緩存,瀏覽器可能會重新下載這些檔案。
在瀏覽器中處理,不會上傳。
關於此工具
音訊和視訊轉文字轉錄器 化繁為簡。
語音辨識功能在您的瀏覽器中本地運行,採用多語言 Whisper Tiny 模型。首次使用時,瀏覽器會從 Hugging Face 下載約 43 MB 的開放式模型檔案;錄音本身不會傳送到 Hugging Face 或 UsefulVerse。您的瀏覽器可能會快取該模型以供日後使用,但您可以清除快取。模型體積小巧,因此請仔細檢查名稱、數字和標點符號,確保無誤。伺服器沒有固定的檔案大小或時長限制;實際限制取決於您的裝置、瀏覽器、記憶體、支援的媒體編解碼器、電池電量和可用儲存空間。強烈建議使用桌上型電腦或筆記型電腦進行長時間或高解析度錄音。首次使用時需連接網路才能下載模型。
常見問題
關於 音訊和視訊轉文字轉錄器
如何將音訊或視訊檔案轉錄為文字?
選擇一段錄音或一段帶有音軌的視頻,選擇一種口語或自動檢測,然後開始轉錄。語音辨識功能在您的裝置上運作。
我的錄音會被上傳進行轉錄嗎?
不會。媒體檔案會在您的瀏覽器中進行解碼和轉錄。首次使用時,系統會下載約 58 MB 的模型和本機引擎檔案;如果清除瀏覽器緩存,則可能需要再次下載這些檔案。
轉錄的準確度如何?
這款緊湊型多語言模型可能會識別錯誤的人名、數字和標點符號。請在依賴或分享轉錄文字之前進行審核。