微軟 VibeVoice-ASR:60 分鐘音檔一次轉錄,三合一結構化輸出的開源語音辨識模型

標題: 微軟 VibeVoice-ASR:60 分鐘音檔一次轉錄,三合一結構化輸出的開源語音辨識模型


作者: 達小編
發表時間: 2026-07-23 02:46:32

AI 工具分享與教學 最新科技新聞 Github VibeVoice VibeVoice-ASR 微軟 語音辨識 開源

描述:

微軟研究院近日開源一個 70 億參數的語音 AI 模型 VibeVoice ,它能在一次處理中轉錄長達 60 […]

The post 微軟 VibeVoice-ASR:60 分鐘音檔一次轉錄,三合一結構化輸出的開源語音辨識模型 appeared first on 電腦王阿達.


時間分享(原讚與享)評論回應(讚與心情)外掛評論