OmniVoice:支持600+语言的零样本TTS语音克隆模型

今天在 GitHub Trending 上看到一个非常有技术深度的项目:OmniVoice,由 k2-fsa 团队开源的零样本多语言 TTS 模型,支持超过 600 种语言的语音克隆与合成,推理速度达...

技术 · 开源 · 周三, 九月 9, 2026 · 6 分钟 · 2705 字

ABot-World:用单张桌面 GPU 实现无限交互式世界仿真

今天在 GitHub Trending 上看到一个让人眼前一亮的项目:ABot-World,来自高德地图 CV 实验室(amap-cvlab)。它仅凭一块 NVIDIA RTX 5090 桌面 GPU,就能...

AI · 计算机视觉 · 开源项目 · 周二, 八月 4, 2026 · 6 分钟 · 2645 字

LongCat-Video:美团开源的 136 亿参数视频生成基础模型

今天在 GitHub Trending 上看到一个重量级的开源项目:LongCat-Video,来自美团长猫团队,是一个拥有 136 亿参数的视频生成基础模型,统—支持文生视频(...

技术 · 开源 · 周五, 七月 31, 2026 · 4 分钟 · 1641 字