VoiceStudio:本地运行的语音克隆、视频配音与多引擎 TTS 工具箱

今天在 GitHub Trending 上看到一个有意思的项目:VoiceStudio,一个本地优先的语音工具平台,支持 16 种 TTS 引擎和 11 种 ASR 引擎,覆盖 646 种语言,让语音克隆、...

技术 · 开源 · AI工具 · 周三, 九月 2, 2026 · 6 分钟 · 2506 字

VibeVoice:微软开源前沿语音 AI 模型家族

今天在 GitHub Trending 上看到一个有意思的项目:VibeVoice,这是微软开源的前沿语音 AI 模型家族,同时覆盖语音识别(ASR)和语音合成(TTS),核心...

技术 · 开源 · AI · 周四, 七月 30, 2026 · 4 分钟 · 1697 字

Hugging Face Speech-to-Speech:一站式语音对话开源引擎

今天在 GitHub Trending 上看到一个有意思的项目:Hugging Face speech-to-speech,一个开源的模块化语音对话引擎,用 pip install speech-to-speech 装好后,三行代码就...

技术 · 开源 · 周五, 七月 10, 2026 · 5 分钟 · 2248 字

VoxCPM2:无分词器多语言TTS系统,支持30种语言语音生成与声音设计

今天在 GitHub Trending 上看到一个有意思的项目:VoxCPM2,这是 OpenBMB 团队发布的无分词器(Tokenizer-Free)TTS 系统,支持 30 种语言语音生成、...

开源 · AI工具 · TTS · 周日, 五月 31, 2026 · 6 分钟 · 2533 字

MOSS-TTS Family:开源高质量语音与声音生成模型家族深度解析

一、项目概述 MOSS-TTS Family 是由 MOSI.AI 和 OpenMOSS 团队 联合推出的开源语音与声音生成模型家族。该项目专为高保真、高表现力、复杂真实场景设计,覆盖: 稳定长文本语音合成 多...

开源项目 · 人工智能 · 语音合成 · 周五, 五月 29, 2026 · 7 分钟 · 3205 字