VibeVoice:微软开源前沿语音 AI 模型家族
今天在 GitHub Trending 上看到一个有意思的项目:VibeVoice,这是微软开源的前沿语音 AI 模型家族,同时覆盖语音识别(ASR)和语音合成(TTS),核心...
今天在 GitHub Trending 上看到一个有意思的项目:VibeVoice,这是微软开源的前沿语音 AI 模型家族,同时覆盖语音识别(ASR)和语音合成(TTS),核心...
今天在 GitHub Trending 上看到一个有意思的项目:Moonshine Voice,这是一套开源的端侧语音 AI 工具包,核心语音识别模型在 HuggingFace 公开基准上精度超越了 Whisper Large...
今天在 GitHub Trending 上看到一个很有意思的项目:transcribe.cpp,一个基于 ggml 运行时的 C/C++ 语音识别推理库,支持 Metal、Vulkan、CUDA...
今天在 GitHub Trending 上看到一个有意思的项目:Hugging Face speech-to-speech,一个开源的模块化语音对话引擎,用 pip install speech-to-speech 装好后,三行代码就...
今天在 GitHub Trending 上看到一个有意思的项目:FluidVoice,这是一款开源的 macOS 语音转文字听写应用,最吸引我的是它内置的 Fluid Intelligence 本地 AI 引擎——所有数据处...