今天我們推出 AI Dictation v2 — 一款基於跨平台 AI Suite v2 技術棧的語音轉文字應用。說話時即時顯示文字,捕捉您電腦播放的會議內容,或匯入錄音 — 獲得乾淨且可編輯的文字。重點很簡單: 在不將您的語音傳送到雲端的情況下,將語音轉成文字。

功能介紹

AI Dictation 可從三個來源轉錄:您的 咪高峰 (即時口述並觀看文字流出),您的 電腦自身音訊 (會議、影片、播客在您的電腦播放時),或您已有的 音訊檔案 。使用免費的本地引擎,整個轉錄過程均在您的裝置上運行 — 即使關閉網絡也能繼續工作。

首次錄音時,應用會為您選擇並下載一個功能強大的本地語音模型,然後在您講話時即時生成字幕。您可選擇語言或讓系統自動偵測,需要時開啟時間戳,並將結果儲存為純文字,作為 SubRip (.srt) 字幕格式WebVTT (.vtt) 字幕格式 用於為影片添加字幕,或以 JSON 格式輸出每段時間碼,方便您自家工具使用。

v2 版本新增功能

  • 三種錄音方式。 麥克風、電腦系統音效或檔案 — 一鍵切換來源,並有即時音量計顯示輸入狀況。
  • 重播及重新轉錄。 每次錄音均會保存,您可使用波形滑桿回放,並在播放時觀看每個字詞高亮。隨時可用更精確的模型重新轉錄,結果會另存為新條目,原始檔案絕不覆蓋。
  • 字幕及淨化匯出。 匯出 SubRip 及 WebVTT 字幕,時間碼精確,亦可匯出 JSON 供工具使用,或純文字。淨化控制可決定如何處理非語音聲音如 [音樂] 或 (笑聲),原始模型輸出則在另一面板查看。
  • 您掌控的歷史記錄。 每份文字稿均本地保存並 靜態加密, 隨時可重新開啟、複製或繼續編輯。可用搜尋功能查找任何文字稿,並可篩選最近錄音清單中包含您輸入字詞的項目。
  • 引擎任您選擇。 免費起步使用裝置內 Whisper 模型。Pro 版解鎖更大型模型、OpenAI 雲端引擎及支援 GPU 的本地引擎,應付最複雜音訊,並內建 GPU 安全限制及保持模型常駐選項,讓重複工作即時啟動。
  • 支援 16 種語言。 整個介面會跟隨您的作業系統語言,一鍵於設定切換,並能轉錄數十種口語語言。
  • 可腳本化。 一款無頭命令行工具,可從終端進行轉錄,並同時作為 MCP 伺服器,讓 AI 代理及其他工具能在您的自有基礎設施上調用。

所有功能均免費提供

與整個套件一樣, 沒有功能被鎖定於專業版。 實時聽寫、系統音頻及文件轉錄、字幕導出、播放、重新轉錄、加密歷史記錄、搜尋及命令行工具均包含於免費應用中,配備強大的本地模型,且無時間限制或煩人提示。專業版僅在於 引擎選擇 — 更大型的本地模型、OpenAI 雲端引擎,以及當您需要更高準確度時的 GPU 加速本地引擎。保持免費身份絕不會失去任何功能。

本地運行的重要性

訪談、會議、醫療筆記、法律聽寫——人們最想轉錄的音頻往往是無法上傳雲端的音頻。AI Dictation 將 AI 帶到您的錄音中:使用本地引擎時,資料不會離開裝置,您的轉錄文本和錄音均以靜態加密保存,且無每分鐘轉錄費用。這是 Software Tailor 所有產品背後相同的本地部署、以隱私為先的原則 [1]

立即下載

AI Dictation v2 現已於 Microsoft Store 提供 Windows 免費下載,當您需要高級及雲端引擎時可選擇專業版 [2]。macOS、Linux、瀏覽器及手機版本正在規劃中。完整功能導覽請參閱 產品頁面