纯浏览器 3D 数字人 Demo

3D 渲染和中文语音识别在浏览器侧完成,回复由阿里云百炼 Qwen 生成,语音播报由 CosyVoice 合成,动作由 MotionEngine 在浏览器内执行,不依赖数字人云渲染服务。

点击「加载数字人」后,约 14 MB 的写实 3D 模型将在本机浏览器中渲染。
未加载
加载数字人后,可以输入文字或点击麦克风提问。

LLM:Qwen 中文回答与动作编排;动作:MotionEngine;TTS:CosyVoice cosyvoice-v3-flash / longanhuan;口型:HeadAudio 实时音频驱动。

引擎:TalkingHead + HeadAudio + MotionEngine(MIT)。HeadAudio 使用声学模型近似识别 中文音频口型,不等同于中文音素级时间戳。示例形象由 Avaturn 创建(照片级写实管线),仅用于非商业演示。