一龍馬/AI 情報站讀懂消息背後的脈絡
星期六
搜尋

VoiceStudio 是可在自有硬體執行的語音製作套件,整合 16 個文字轉語音引擎與 11 個語音辨識引擎,涵蓋聲音複製、聲音設計、影片配音、聽寫、轉錄及有聲書製作

Python · ⭐ 17,808 · 🍴 2,336 · 🔥今日 +1,345

中文摘要

它提供桌面程式、Docker、地端 API、OpenAI 相容音訊 API 與 MCP Server,專案、聲音和輸出預設留在本機;README 宣稱語言目錄達 646 種,但明確說明實際支援與品質取決於引擎。專案仍是 active beta,macOS 地端後端只支援 Apple Silicon,Linux 要求 glibc 2.39 以上,且首次啟動須建立 Python 環境並下載模型。

一龍馬判讀

內容工作者與開發團隊可避開按量計費及將聲音素材交給雲端服務,但硬體相容性、各引擎品質與模型授權仍需個別評估。應用程式採 AGPL-3.0,下載模型則沿用各自上游條款,商用前不能視為單一授權。

原文節錄

debpalash/VoiceStudio

VoiceStudio Previously OmniVoice-Studio Clone voices, dub video, dictate, and produce long-form audio on your own hardware.

取得部分原文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

VoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning, voice design, video dubbing, dictation, transcription & audiobook creation in 646 languages.

收錄日期
2026-09-05
來源
github.com/trending
抓取時間
2026/09/05 05:50(台北)
來源資料
Python · ⭐ 17,808 · 🍴 2,336 · 🔥今日 +1,345