纯浏览器 3D 数字人 Demo
3D 渲染和中文语音识别在浏览器侧完成,回复由阿里云百炼 Qwen 生成,语音播报由 CosyVoice 合成,动作由 MotionEngine 在浏览器内执行,不依赖数字人云渲染服务。
CosyVoice 音频由本站后端安全代理,API Key 不会进入浏览器。HeadAudio 驱动口型,
MotionEngine 按台词时间线执行白名单语义动作;语音识别建议使用最新版 Chrome 或 Edge。
点击「加载数字人」后,约 14 MB 的写实 3D 模型将在本机浏览器中渲染。
未加载
加载数字人后,可以输入文字或点击麦克风提问。
LLM:Qwen 中文回答与动作编排;动作:MotionEngine;TTS:CosyVoice
cosyvoice-v3-flash / longanhuan;口型:HeadAudio 实时音频驱动。
引擎:TalkingHead + HeadAudio + MotionEngine(MIT)。HeadAudio 使用声学模型近似识别 中文音频口型,不等同于中文音素级时间戳。示例形象由 Avaturn 创建(照片级写实管线),仅用于非商业演示。