EZ
EZ2Conv

語音轉文字

使用瀏覽器語音辨識,將您的語音即時轉換為文字。也可使用本地Whisper AI轉錄音訊和影片檔案。免費、安全,無需登入。

Characters
0
Words
0
Sentences
0
Duration
00:00

Transcript

You can edit the text below

使用方法

  1. 【即時】選擇「即時」標籤頁,選擇您的語言,然後點擊「開始錄音」
  2. 【即時】對著麥克風清晰地說話,文字會在您說話時即時顯示
  3. 【檔案上傳】選擇「檔案上傳」標籤頁,選擇AI模型並上傳音訊/影片檔案
  4. 【檔案上傳】點擊「轉錄」,AI模型會在首次使用時自動下載
  5. 完成後使用可用選項編輯、複製或下載您的轉錄文字

實用技巧

  • 即時模式需要 Chrome、Edge 或 Safari 瀏覽器
  • 檔案上傳在下載 AI 模型後可離線使用
  • 對於長檔案,「Tiny」模型提供最快的處理速度
  • 只有檔案上傳會將音訊保留在您的裝置上;除非可使用裝置端辨識,否則即時模式會將音訊傳送至瀏覽器的語音服務

把語音轉成文字的兩種方式

這個工具的作用

Speech to Text 提供兩套彼此獨立、目標相同的引擎。即時模式使用現代瀏覽器內建的 Web Speech API(SpeechRecognition 介面),在你說話的同時把文字寫到頁面上:先顯示暫定文字,停頓後再變成確定的一行。檔案上傳模式則透過 Transformers.js 載入 Whisper AI 模型,直接把你手邊的錄音轉成文字,完全不需要聆聽麥克風。

何時使用哪種模式

即時聽寫適合在不動手的情況下記下想法:會議筆記、快速草稿,或是寧可用說的備忘。文字即時出現,能在短時間的現場作業中維持節奏。

檔案上傳則更適合已經錄好的素材,例如訪談、課程、語音備忘,或影片的音軌。Whisper 模型完成第一次下載後,這個模式即使沒有連線也能繼續運作,對長錄音和重複作業都很方便。

快速操作流程

要現場使用時,從清單挑選語言,按下 Start Recording,瀏覽器詢問時允許使用麥克風;你的聲音會填入逐字稿,之後也能修改。要處理錄音時,切換到 File Upload,選擇模型——追求速度用 Tiny,追求多語準確度用 Small——再放入 MP3、WAV、MP4 之類的檔案。處理完成後,文字就能複製或下載。

支援情況與注意事項

即時辨識取決於瀏覽器:Chrome、Edge、Safari 都實作 Web Speech API,Firefox 則沒有,因此在 Firefox 建議改用 File Upload。較新的 Chrome 可以在裝置上安裝語言模型,把麥克風音訊留在本機;否則辨識會交給瀏覽器廠商的語音服務。即時清單提供 22 種語言,Whisper 則以自動偵測涵蓋超過 99 種。上傳支援常見的音訊與影片格式,上限 500MB;若是影片,先把音訊抽出來會讓處理更快、結果更好。

常見問題

兩套引擎都沒有使用限制:以 Web Speech API 進行的現場聽寫,以及用 Whisper 的 Tiny、Base、Small 模型進行的檔案轉錄,音訊或影片不限長度。沒有按分鐘計費,也沒有付費才能解鎖的模型。
要看使用哪種模式。檔案轉錄以 Transformers.js 在裝置內執行 Whisper 模型,錄音與文字都不會離開裝置。即時模式使用瀏覽器的 Web Speech API,通常會把麥克風音訊送到廠商伺服器進行辨識(Chrome 已在裝置安裝模型時除外)。EZ2Conv 不會收到你的音訊。
不需要任何帳號。選好模式,開口說或上傳錄音,接著就能編輯、複製或下載文字。不會要求電子郵件或個人資料。
即時模式所需的 Web Speech API 由 Chrome、Edge、Safari 實作,Firefox 並未內建。不過 File Upload 模式不依賴這個 API,而是用 Whisper 轉錄,因此在任何瀏覽器都能運作。
即時模式需要麥克風才能收錄你的聲音,瀏覽器會詢問一次。若拒絕,這個模式就無法聽取,但檔案上傳讀取的是既有錄音,並不需要麥克風。
即時清單透過 Web Speech API 提供 22 種語言,檔案模式則以 Whisper 自動偵測辨識超過 99 種。錄音前先選好語言可以提升準確度。