拖放任何音訊或影片檔,選擇語言,取得含時間戳記的完整逐字稿 - 全在瀏覽器中。模型僅下載一次 (~75 MB),並會快取於本機,後續執行即時且可離線使用。
辨識在本地執行. 你的音訊不會離開裝置.
模型已緩存在您的瀏覽器中。後續執行可離線運作。
無需帳號、無需點數、無使用上限。開放即用。
語音辨識通常意味著將您的音訊上傳到別人的 GPU。在這裡,模型改為在您自己的機器上執行,這使得該工具同時免費且私密。
取捨在於模型大小。裝置上的權重只是託管服務執行的一小部分,因此在嘈雜的音訊、濃重的口音和重疊的說話者上,準確性會下降 - 這就是下方雲端選項的用武之地。
免費的瀏覽器內工具運行一個小型開源模型——對於清晰的音訊來說很好,但它可能難以處理濃重的口音、噪音或重疊的說話者,並且只涵蓋有限的語言集。若要獲得廣播級的準確度、更廣泛的語言支援以及 SRT/VTT/TXT 下載,請使用我們付費的雲端語音轉文字服務。
試用雲端語音轉文字