實測 2026-10-09

實測:用 Whisper 把會議錄音轉成逐字稿

開完會要出逐字稿,一向是最花時間的一環。這次把整段會議錄音交給開源的語音辨識模型,看看能否省下大部分整理時間。

實測做法

把錄音檔轉成模型支援的格式,以中等模型規模在本機跑一次,全程不需上傳到雲端,錄音內容留在自己的電腦。

實測結果

一小時的會議錄音,處理時間約十餘分鐘。中英夾雜的句子大致準確;專有名詞與人名較容易出錯,需要人手覆核。

幾點觀察

  • 適合先出一份初稿,再人手修正,可省下大量打字時間
  • 錄音品質直接影響準確度,收音要清楚
  • 多人同時發言的部分,較難辨別誰在說話

小結

值得長期使用,但現階段仍要人手把關。之後會再試不同模型規模,比較速度與準確度的取捨。

實測AI