這頁該怎麼讀
這裡列的是可查證的訊號,不是稽核結果。任何一項都不構成背書。
社群把 VibeVoice 包成了 ComfyUI 節點、桌面應用、API 伺服器與原生移植。這裡整理有哪些,以及在你執行它們之前該確認什麼。數據擷取於 2026 年 9 月;點卡片看細節與 repo 連結。
23 筆結果
這裡列的是可查證的訊號,不是稽核結果。任何一項都不構成背書。
ComfyUI 自訂節點就是以你的權限執行的任意 Python。這個管道已經被真實濫用過。
VibeVoice 的 Pinokio、RunPod、Colab 腳本都有人做——但每一個都規模極小且沒有授權。
微軟從未發布 7B 的 TTS 權重。所有熱門包裝都是去第三方轉傳處抓的。
搜尋結果中 star 第 12 高的,是一個毫不相關的聽寫工具。要看擁有者,不是看名字。
MIT 讓任何人都能 fork——包括繞過防護。但你的義務不會跟著 fork 消失。
把被下架的 TTS 程式碼接住的 fork——1.6k star、739 fork,仍在維護。
微軟下架當天做的官方 repo 快照。此後就凍結了。
star 數最高的 ComfyUI 整合——但最後推送停在 2026 年 2 月。
另一個知名的 ComfyUI 節點——但已經約一年沒有動過。
多引擎的 ComfyUI 套件,VibeVoice 只是其中一個 TTS 後端。維護活躍。
Gradio 網頁介面的聲音複製工具,把 VibeVoice 與 Qwen3-TTS、Whisper 搭在一起。
跨多個 TTS 模型的有聲書製作流程,附同步閱讀器。維護活躍。
本地端的多模型 TTS 工作室,定位是 ElevenLabs 的開源替代。
真正的桌面應用(Tauri 2.0),做有聲書用——拖放編排、17+ 種語言、可輸出 MP3/M4A。
全端多語者網頁系統——但它完全沒有附授權。
Windows 一鍵免安裝的 ASR——完全離線、需 NVIDIA GPU。近期仍在更新。
OpenAI API 相容的 TTS 端點,後面接 Realtime-0.5B。附 Docker。
包在 1.5B 與 7B 模型外面的輕量 FastAPI。規模小但還算跟得上。
建在 ggml 上的 C++ 移植——完全不需要 Python 環境。本頁下載量最高的權重。
Rust 實作,支援聲音複製與多語者。
Realtime-0.5B 的 Swift 移植,給 Apple 平台用。
純 MLX 的 Apple Silicon 語音套件——合成、複製、對話與辨識。本月仍在更新。