Skip to content

🎙️ 即時轉錄

WiseMindAI 即時轉錄適合會議、課堂、訪談和臨時靈感等場景。開始錄音後,辨識內容會隨著講話即時顯示,不需要等整段錄音結束後再處理。

從 v1.3.1 起,除了線上轉錄平台,也可以使用 FunASR 本機即時轉錄。模型準備完成後,聲音會直接在目前電腦上辨識,不會上傳錄音,也不會產生雲端轉錄費用。

轉錄結束後,你還可以讓 AI 把逐字稿整理成紀要、重點和待辦事項,再儲存到文件、筆記或知識庫。這樣從記錄現場內容到整理長期資料,可以在同一個流程裡完成。

使用前準備

請先在「設定 → 模型設定 → 即時轉錄」中選擇一種方式。使用 FunASR 時需要先下載或匯入本機模型;使用線上平台時需要填寫對應的驗證資訊。第一次正式錄音前,請先檢測麥克風是否可以正常收到聲音。

💡 功能介紹

  • 邊錄音邊生成逐字稿,正在辨識的內容也會及時顯示。
  • 支援暫停、繼續和安全結束,不必因為臨時中斷重新開始。
  • 開始錄音後可以切換到文件、筆記或知識庫繼續工作,錄音不會停止。
  • 可以把某句話標記為重點、待辦事項或問題。
  • 支援會議、課堂、訪談和靈感等紀要範本。
  • 儲存錄音後,可以點擊逐字稿回到對應時間繼續播放。
  • 支援匯入已有音訊,與即時轉錄記錄放在一起管理。
  • 逐字稿支援搜尋、整篇或逐段編輯、合併內容、恢復誤刪段落和 AI 優化。
  • 支援修改、合併或重新指定發言人。
  • 儲存到文件或知識庫後,可以在資料詳情中回聽錄音並查看逐字稿。
  • 遇到裝置或程式異常時,會盡量保留已經辨識的內容。

📖 使用教學

1. 配置即時轉錄模型

開啟 WiseMindAI 左下角「設定」,進入「模型設定」,選擇「即時轉錄」。

如果希望錄音不上傳,請選擇 FunASR 本機轉錄,再依內容和電腦配置準備模型:

  • 中英輕量版:適合中文、英文和中英混合內容,佔用的空間和記憶體較少。
  • 中英高精度版:體積和記憶體佔用較大,適合更重視辨識效果的場景。
  • 粵語專用版:同時支援普通話、粵語和英文,錄製粵語時需要明確選擇。

如果無法在目前電腦上直接下載,可以從其他裝置準備 FunASR 離線套件,再匯入壓縮檔或已經解壓縮的模型資料夾。匯入前會檢查檔案完整性、模型類型和可用空間。

WiseMindAI 即時轉錄

如果使用線上平台,新增所需的驗證資訊和模型參數後,可以直接點擊「測試」,確認目前配置是否能夠正常返回辨識文字。

線上平台的即時語音辨識和音影片檔案轉寫可能是兩類不同服務,配置時請確認已開通對應產品。FunASR 則可以在即時轉錄和既有音訊轉寫之間共用同一份本機模型。

WiseMindAI 音影片轉錄服務

如果還沒有準備服務商帳號,可以先查看音影片轉錄服務 Key

2. 開始一段轉錄

開啟左側「轉錄」頁面,點擊「開始轉錄」。開始前可以設定標題,並選擇:

  • 使用場景:會議、課堂、訪談、靈感或其他。
  • 錄音裝置:系統預設麥克風或目前連接的其他裝置。
  • 語音辨識平台:預設使用模型設定中目前啟用的平台。
  • 是否儲存錄音:需要回放和按時間定位時,建議保留原始錄音。

點擊「檢測麥克風」,對著目前裝置說話。看到輸入強度變化並提示檢測到聲音後,再開始正式轉錄。

開始前,頁面還會顯示目前方案的單次可用時長和剩餘額度。達到時長限制時,WiseMindAI 會先結束錄音並儲存已有內容。

WiseMindAI 音影片轉錄服務

3. 邊聽邊整理重點

開始後,逐字稿會隨著講話持續顯示。正在辨識但還沒有完全確認的文字會先標記為「辨識中」,確認後再進入正式逐字稿。

錄音期間可以切換到文件、筆記、知識庫或其他頁面繼續工作。頁面底部和桌面寵物會顯示目前錄製狀態,可以隨時暫停、繼續或回到轉錄頁面。

頁面預設會跟隨最新內容。如果你手動向上查看前面的記錄,自動跟隨會暫時停止,不會一直把頁面拉回底部。

錄音過程中可以隨時:

  • 點擊「暫停」暫時停止辨識,再點擊「繼續」恢復。
  • 把目前內容標記為重點、待辦事項或問題。
  • 查看連線狀態、聲音輸入和已錄製時長。
  • 在裝置斷開、沒有聲音或網路重新連線時查看頁面提示。

4. 結束錄音並生成紀要

點擊「結束」後,WiseMindAI 會先等待轉錄平台返回最後一段內容,再安全儲存目前記錄。已有文字不會因為結束錄音而被直接丟棄。

轉錄完成後,點擊「生成紀要」,並根據內容選擇範本:

  • 會議:重點整理結論、分歧、決策和行動項目。
  • 課堂:重點整理知識點、概念解釋、例子和複習事項。
  • 訪談:重點整理問答脈絡、受訪者觀點和關鍵引述。
  • 靈感:重點整理核心想法、延伸方向和下一步嘗試。

AI 會根據完整逐字稿生成紀要、重點和待辦事項。生成後仍然可以重新整理,不會影響原始逐字稿。

WiseMindAI 音影片轉錄服務

5. 搜尋、編輯和回放逐字稿

進入轉錄詳情後,可以搜尋逐字稿、逐條定位和修改內容,也可以使用「編輯全部」集中校對。編輯時還可以合併連續內容、恢復誤刪段落,或讓 AI 優化口語、重複內容和明顯的辨識錯誤。

發言人也可以重新命名、合併或重新指定。調整後,對應的逐字稿會一起更新。

如果開始前選擇了儲存錄音,點擊某一段逐字稿或重點,就可以從對應時間繼續播放。播放器還支援調整速度,以及前後跳轉 10 秒,適合校對專有名詞或重新確認上下文。

6. 儲存和匯出

整理完成後,可以按需要儲存:

  • 儲存到文件:把逐字稿儲存為 Markdown 文件。
  • 儲存到筆記:把紀要、重點、待辦事項或逐字稿儲存為筆記。
  • 放入知識庫:把轉錄內容作為資料加入指定知識庫。
  • 匯出檔案:可以選擇純文字或帶時間戳記的格式。

儲存到文件或知識庫後,資料詳情會保留轉錄內容與錄音的關聯。你可以直接查看逐字稿、播放原始音訊,再繼續總結、提問或生成學習內容。

支援哪些即時轉錄平台?

WiseMindAI 的即時轉錄模型設定中提供 FunASR 本機轉錄,以及阿里雲百煉、火山引擎、科大訊飛、百度智能雲、騰訊雲等線上平台。

線上平台需要填寫的驗證資訊、模型名稱和可用語言不同,配置前請先在服務商控制台開通即時語音辨識服務,並確認帳號仍有可用額度。FunASR 不需要 Key,但需要先準備本機模型。實際可選擇的平台以目前客戶端的模型設定頁面為準。

🌈 適合什麼場景

  • 會議記錄:現場標記結論和待辦事項,會後直接生成會議紀要。
  • 課堂聽課:保留完整講解,再整理知識點、例子和複習內容。
  • 訪談整理:按時間儲存問答過程,方便回聽和提取觀點。
  • 靈感記錄:邊說邊記,不需要先停下來手動輸入。
  • 已有錄音整理:匯入過去的課程、採訪和語音備忘錄,統一生成逐字稿。

常見問題

即時轉錄和音影片轉寫有什麼區別?

即時轉錄接收麥克風的連續聲音,適合正在進行的會議和課堂;音影片轉寫處理已經儲存的檔案,適合整理過去錄製的內容。線上服務可能需要分別配置,FunASR 則可以在兩個入口共用同一份本機模型。

為什麼開始後沒有辨識到文字?

先檢查目前頁面是否顯示聲音輸入,再確認麥克風權限、錄音裝置和即時轉錄模型是否正常。建議依次使用「檢測麥克風」和模型設定中的「測試」功能排查。

手動查看前面的逐字稿時,頁面為什麼不再自動捲動?

這是正常行為。WiseMindAI 會判斷你正在查看歷史內容,暫時停止自動跟隨。回到底部後,會繼續顯示最新辨識結果。

錄音意外中斷後還能恢復嗎?

重新進入轉錄頁面時,如果發現未完成記錄,可以選擇儲存已有內容。能否保留完整錄音和最後一段文字,仍會受到裝置狀態和轉錄平台返回結果的影響。

即時轉錄會產生費用嗎?

使用 FunASR 本機轉錄不會產生雲端轉錄費用,但會佔用目前電腦的空間、記憶體和運算資源。線上即時轉錄通常會按時長或請求量計費,費用由模型服務商收取。