一龍馬/AI 情報站讀懂消息背後的脈絡
星期五
搜尋

README 宣稱語言目錄涵蓋 646 種語言,但明確註明實際支援與品質取決於所選引擎;聲音複製可從 3 秒樣本開始,建議使用 5 至 15 秒較乾淨的錄音

Python · ⭐ 16,141 · 🍴 2,196 · 🔥今日 +1,738

中文摘要

VoiceStudio 主打完全在本機執行的語音工作站,涵蓋聲音複製與設計、影片配音、聽寫、轉錄及有聲書製作,提供 16 套 TTS、11 套 ASR 引擎,以及桌面程式、本機 API、OpenAI 相容音訊 API與 MCP Server。README 宣稱語言目錄涵蓋 646 種語言,但明確註明實際支援與品質取決於所選引擎;聲音複製可從 3 秒樣本開始,建議使用 5 至 15 秒較乾淨的錄音。專案仍是 active beta,支援 Apple Silicon、Windows x64、特定 Linux 環境與 Docker,應用採 AGPL-3.0,而下載模型各自沿用上游授權。

一龍馬判讀

對重視隱私、離線處理或不想按量付費的創作者與企業,這套工具把多個語音流程收進單一本機介面;但硬體相容性、各語言品質、模型授權與 beta 階段的變動,都是正式製作前必須逐項驗證的限制。

原文節錄

debpalash/VoiceStudio

VoiceStudio Previously OmniVoice-Studio Clone voices, dub video, dictate, and produce long-form audio on your own hardware.

取得部分原文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

VoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning, voice design, video dubbing, dictation, transcription & audiobook creation in 646 languages.

收錄日期
2026-09-04
來源
github.com/trending
抓取時間
2026/09/04 05:50(台北)
來源資料
Python · ⭐ 16,141 · 🍴 2,196 · 🔥今日 +1,738