OmniVoice:支持600+语言的零样本TTS语音克隆模型
今天在 GitHub Trending 上看到一个非常有技术深度的项目:OmniVoice,由 k2-fsa 团队开源的零样本多语言 TTS 模型,支持超过 600 种语言的语音克隆与合成,推理速度达...
今天在 GitHub Trending 上看到一个非常有技术深度的项目:OmniVoice,由 k2-fsa 团队开源的零样本多语言 TTS 模型,支持超过 600 种语言的语音克隆与合成,推理速度达...
今天在 GitHub Trending 上看到一个有意思的项目:VoiceStudio,一个本地优先的语音工具平台,支持 16 种 TTS 引擎和 11 种 ASR 引擎,覆盖 646 种语言,让语音克隆、...
今天在 GitHub Trending 上看到一个有意思的项目:Voice-Pro,它是一个把 YouTube 下载、人声分离、语音识别、翻译和语音合成打包进同一个 WebUI 的本地化 AI 配音工作流...
今天在 GitHub Trending 上看到一个有意思的项目:VibeVoice,这是微软开源的前沿语音 AI 模型家族,同时覆盖语音识别(ASR)和语音合成(TTS),核心...
今天在 GitHub Trending 上看到一个有意思的项目:Moonshine Voice,这是一套开源的端侧语音 AI 工具包,核心语音识别模型在 HuggingFace 公开基准上精度超越了 Whisper Large...