🎙️ 即時轉錄
WiseMindAI 即時轉錄適合會議、課堂、訪談和臨時靈感等場景。開始錄音後,辨識內容會隨著講話即時顯示,不需要等整段錄音結束後再處理。
從 v1.3.1 起,除了線上轉錄平台,也可以使用 FunASR 本機即時轉錄。模型準備完成後,聲音會直接在目前電腦上辨識,不會上傳錄音,也不會產生雲端轉錄費用。
轉錄結束後,你還可以讓 AI 把逐字稿整理成紀要、重點和待辦事項,再儲存到文件、筆記或知識庫。這樣從記錄現場內容到整理長期資料,可以在同一個流程裡完成。
使用前準備
請先在「設定 → 模型設定 → 即時轉錄」中選擇一種方式。使用 FunASR 時需要先下載或匯入本機模型;使用線上平台時需要填寫對應的驗證資訊。第一次正式錄音前,請先檢測麥克風是否可以正常收到聲音。
💡 功能介紹
- 邊錄音邊生成逐字稿,正在辨識的內容也會及時顯示。
- 支援暫停、繼續和安全結束,不必因為臨時中斷重新開始。
- 開始錄音後可以切換到文件、筆記或知識庫繼續工作,錄音不會停止。
- 可以把某句話標記為重點、待辦事項或問題。
- 支援會議、課堂、訪談和靈感等紀要範本。
- 儲存錄音後,可以點擊逐字稿回到對應時間繼續播放。
- 支援匯入已有音訊,與即時轉錄記錄放在一起管理。
- 逐字稿支援搜尋、整篇或逐段編輯、合併內容、恢復誤刪段落和 AI 優化。
- 支援修改、合併或重新指定發言人。
- 儲存到文件或知識庫後,可以在資料詳情中回聽錄音並查看逐字稿。
- 遇到裝置或程式異常時,會盡量保留已經辨識的內容。
📖 使用教學
1. 配置即時轉錄模型
開啟 WiseMindAI 左下角「設定」,進入「模型設定」,選擇「即時轉錄」。
如果希望錄音不上傳,請選擇 FunASR 本機轉錄,再依內容和電腦配置準備模型:
- 中英輕量版:適合中文、英文和中英混合內容,佔用的空間和記憶體較少。
- 中英高精度版:體積和記憶體佔用較大,適合更重視辨識效果的場景。
- 粵語專用版:同時支援普通話、粵語和英文,錄製粵語時需要明確選擇。
如果無法在目前電腦上直接下載,可以從其他裝置準備 FunASR 離線套件,再匯入壓縮檔或已經解壓縮的模型資料夾。匯入前會檢查檔案完整性、模型類型和可用空間。

如果使用線上平台,新增所需的驗證資訊和模型參數後,可以直接點擊「測試」,確認目前配置是否能夠正常返回辨識文字。
線上平台的即時語音辨識和音影片檔案轉寫可能是兩類不同服務,配置時請確認已開通對應產品。FunASR 則可以在即時轉錄和既有音訊轉寫之間共用同一份本機模型。

如果還沒有準備服務商帳號,可以先查看音影片轉錄服務 Key。
2. 開始一段轉錄
開啟左側「轉錄」頁面,點擊「開始轉錄」。開始前可以設定標題,並選擇:
- 使用場景:會議、課堂、訪談、靈感或其他。
- 錄音裝置:系統預設麥克風或目前連接的其他裝置。
- 語音辨識平台:預設使用模型設定中目前啟用的平台。
- 是否儲存錄音:需要回放和按時間定位時,建議保留原始錄音。
點擊「檢測麥克風」,對著目前裝置說話。看到輸入強度變化並提示檢測到聲音後,再開始正式轉錄。
開始前,頁面還會顯示目前方案的單次可用時長和剩餘額度。達到時長限制時,WiseMindAI 會先結束錄音並儲存已有內容。

3. 邊聽邊整理重點
開始後,逐字稿會隨著講話持續顯示。正在辨識但還沒有完全確認的文字會先標記為「辨識中」,確認後再進入正式逐字稿。
錄音期間可以切換到文件、筆記、知識庫或其他頁面繼續工作。頁面底部和桌面寵物會顯示目前錄製狀態,可以隨時暫停、繼續或回到轉錄頁面。
頁面預設會跟隨最新內容。如果你手動向上查看前面的記錄,自動跟隨會暫時停止,不會一直把頁面拉回底部。
錄音過程中可以隨時:
- 點擊「暫停」暫時停止辨識,再點擊「繼續」恢復。
- 把目前內容標記為重點、待辦事項或問題。
- 查看連線狀態、聲音輸入和已錄製時長。
- 在裝置斷開、沒有聲音或網路重新連線時查看頁面提示。
4. 結束錄音並生成紀要
點擊「結束」後,WiseMindAI 會先等待轉錄平台返回最後一段內容,再安全儲存目前記錄。已有文字不會因為結束錄音而被直接丟棄。
轉錄完成後,點擊「生成紀要」,並根據內容選擇範本:
- 會議:重點整理結論、分歧、決策和行動項目。
- 課堂:重點整理知識點、概念解釋、例子和複習事項。
- 訪談:重點整理問答脈絡、受訪者觀點和關鍵引述。
- 靈感:重點整理核心想法、延伸方向和下一步嘗試。
AI 會根據完整逐字稿生成紀要、重點和待辦事項。生成後仍然可以重新整理,不會影響原始逐字稿。

5. 搜尋、編輯和回放逐字稿
進入轉錄詳情後,可以搜尋逐字稿、逐條定位和修改內容,也可以使用「編輯全部」集中校對。編輯時還可以合併連續內容、恢復誤刪段落,或讓 AI 優化口語、重複內容和明顯的辨識錯誤。
發言人也可以重新命名、合併或重新指定。調整後,對應的逐字稿會一起更新。
如果開始前選擇了儲存錄音,點擊某一段逐字稿或重點,就可以從對應時間繼續播放。播放器還支援調整速度,以及前後跳轉 10 秒,適合校對專有名詞或重新確認上下文。
6. 儲存和匯出
整理完成後,可以按需要儲存:
- 儲存到文件:把逐字稿儲存為 Markdown 文件。
- 儲存到筆記:把紀要、重點、待辦事項或逐字稿儲存為筆記。
- 放入知識庫:把轉錄內容作為資料加入指定知識庫。
- 匯出檔案:可以選擇純文字或帶時間戳記的格式。
儲存到文件或知識庫後,資料詳情會保留轉錄內容與錄音的關聯。你可以直接查看逐字稿、播放原始音訊,再繼續總結、提問或生成學習內容。
支援哪些即時轉錄平台?
WiseMindAI 的即時轉錄模型設定中提供 FunASR 本機轉錄,以及阿里雲百煉、火山引擎、科大訊飛、百度智能雲、騰訊雲等線上平台。
線上平台需要填寫的驗證資訊、模型名稱和可用語言不同,配置前請先在服務商控制台開通即時語音辨識服務,並確認帳號仍有可用額度。FunASR 不需要 Key,但需要先準備本機模型。實際可選擇的平台以目前客戶端的模型設定頁面為準。
🌈 適合什麼場景
- 會議記錄:現場標記結論和待辦事項,會後直接生成會議紀要。
- 課堂聽課:保留完整講解,再整理知識點、例子和複習內容。
- 訪談整理:按時間儲存問答過程,方便回聽和提取觀點。
- 靈感記錄:邊說邊記,不需要先停下來手動輸入。
- 已有錄音整理:匯入過去的課程、採訪和語音備忘錄,統一生成逐字稿。
常見問題
即時轉錄和音影片轉寫有什麼區別?
即時轉錄接收麥克風的連續聲音,適合正在進行的會議和課堂;音影片轉寫處理已經儲存的檔案,適合整理過去錄製的內容。線上服務可能需要分別配置,FunASR 則可以在兩個入口共用同一份本機模型。
為什麼開始後沒有辨識到文字?
先檢查目前頁面是否顯示聲音輸入,再確認麥克風權限、錄音裝置和即時轉錄模型是否正常。建議依次使用「檢測麥克風」和模型設定中的「測試」功能排查。
手動查看前面的逐字稿時,頁面為什麼不再自動捲動?
這是正常行為。WiseMindAI 會判斷你正在查看歷史內容,暫時停止自動跟隨。回到底部後,會繼續顯示最新辨識結果。
錄音意外中斷後還能恢復嗎?
重新進入轉錄頁面時,如果發現未完成記錄,可以選擇儲存已有內容。能否保留完整錄音和最後一段文字,仍會受到裝置狀態和轉錄平台返回結果的影響。
即時轉錄會產生費用嗎?
使用 FunASR 本機轉錄不會產生雲端轉錄費用,但會佔用目前電腦的空間、記憶體和運算資源。線上即時轉錄通常會按時長或請求量計費,費用由模型服務商收取。
