TAG:实时TTS
微软开源实时语音模型VibeVoice,0.5B参数实现300毫秒响应,支持90分钟长音频流畅播放
微软开源实时语音模型VibeVoice-Realtime-0.5B,具备极低延迟(300ms开声)、超长音频生成(90分钟不喘)和多角色对话(支持4人)等强大功能。模型轻量高效,支持中英文,情感表达自然,适用于实时语音助手、有声阅读等场景,已在HuggingFace开源。
均普智能回应募投延期及场地出租 重启10亿元定增布局机器人领域
2026-03-07
0 浏览
大厂布局养龙虾产业 腾讯小米纷纷涉足背后有何考量
2026-03-07
0 浏览
AI助力养龙虾热潮 腾讯小米布局上门安装服务
2026-03-07
0 浏览
OpenClaw爆火引热议,不同群体以独特方式参与安装热潮
2026-03-07
0 浏览
刘忠军教授:推动创新医疗技术在AI领域的应用
2026-03-07
0 浏览
李萌:人形机器人何时迎来"iPhone时刻"?智能玩具或成新兴大产业
2026-03-07
0 浏览
帕西尼再获超10亿融资 估值突破百亿 以全球唯一百亿级实采全模态数据重塑具身智能模型天花板
2026-03-07
0 浏览
斯坦福李飞飞团队提出新框架 机器人可从错误中学习
2026-03-07
0 浏览
西南科大爬壁机器人实现全角度翻转突破
2026-03-07
0 浏览
穆南杉提出人类AI智能体生命进化理论
2026-03-07
0 浏览