OmniVoice:支持600+语言的零样本TTS语音克隆模型

今天在 GitHub Trending 上看到一个非常有技术深度的项目:OmniVoice,由 k2-fsa 团队开源的零样本多语言 TTS 模型,支持超过 600 种语言的语音克隆与合成,推理速度达...

技术 · 开源 · 周三, 九月 9, 2026 · 6 分钟 · 2705 字

VoiceStudio:本地运行的语音克隆、视频配音与多引擎 TTS 工具箱

今天在 GitHub Trending 上看到一个有意思的项目:VoiceStudio,一个本地优先的语音工具平台,支持 16 种 TTS 引擎和 11 种 ASR 引擎,覆盖 646 种语言,让语音克隆、...

技术 · 开源 · AI工具 · 周三, 九月 2, 2026 · 6 分钟 · 2506 字

Voice-Pro:集语音识别、翻译与声音克隆于一体的开源配音神器

今天在 GitHub Trending 上看到一个有意思的项目:Voice-Pro,它是一个把 YouTube 下载、人声分离、语音识别、翻译和语音合成打包进同一个 WebUI 的本地化 AI 配音工作流...

开源 · 工具 · 周日, 八月 2, 2026 · 6 分钟 · 2762 字

VibeVoice:微软开源前沿语音 AI 模型家族

今天在 GitHub Trending 上看到一个有意思的项目:VibeVoice,这是微软开源的前沿语音 AI 模型家族,同时覆盖语音识别(ASR)和语音合成(TTS),核心...

技术 · 开源 · AI · 周四, 七月 30, 2026 · 4 分钟 · 1697 字

Moonshine Voice:让语音交互真正属于所有人,端侧运行还比 Whisper 更准

今天在 GitHub Trending 上看到一个有意思的项目:Moonshine Voice,这是一套开源的端侧语音 AI 工具包,核心语音识别模型在 HuggingFace 公开基准上精度超越了 Whisper Large...

技术 · 开源 · AI · 周二, 七月 21, 2026 · 5 分钟 · 2478 字