3D 数字人的成长养成记

3D 数字人的成长养成记:从一张 VRM 模型,到愿意认真听你说话的「晚晴」

晚晴

你有没有想过,数字人不只是"会说话"

很多数字人项目的第一句话是:"你好,我可以为你提供帮助。"

但真正让人愿意留下来的,往往不是这句标准答案,而是另一种感觉:

你说"今天有点累",她没有急着讲道理;

你说"我好像搞砸了",她先安静听完;

你只是打开页面发了一会儿呆,她也不会催你赶紧开始。

这就是我们正在做的 「数伴」:一个运行在浏览器里的 3D 数字陪伴原型。

她叫 晚晴

晚晴不是一个被固定在页面上的头像。她会在房间里呼吸、眨眼、看向四周;听你说话时有真实的口型变化;回应你时,会根据语气和内容切换表情与动作。她可以挥手、点头、轻笑、思考、拥抱,也可以在你需要的时候,什么都不急着做。

我们是怎样把"她"一点点养成的

第一步:先让她拥有一个可以待着的地方

我们用 Three.js 搭起三维场景,用 VRM 模型承载角色,再放进一个低多边形房间。

这不是为了堆砌炫技,而是想让每次打开页面都有"来到了某个地方"的感觉。镜头、灯光、雾效和渲染预算都经过控制,让角色在桌面端和普通设备上保持稳定的陪伴感。

第二步:让她不说话时也像"活着"

数字人的自然感,常常藏在台词之外。

晚晴有呼吸、眨眼、重心变化、环顾和放松等 idle 动画。她不会一直僵直地站着,也不会每次都重复同一个动作。动画调度器会在待机、对话和互动之间切换,让她更像一个正在房间里等你的人。

第三步:让声音和表情对得上

当晚晴开始说话,系统会同步处理音频活动、口型和动作。

轻声安慰时,她会放慢动作、露出放松的表情;听到好消息时,她会笑着庆祝;遇到疑惑时,她会思考、歪头或轻轻耸肩。语音表现控制器会根据对话片段选择合适的表达,让"说什么"和"怎么说"尽量保持一致。

第四步:把主动权交还给你

你可以直接打开互动工具,让晚晴挥手、跳舞、鞠躬、敬礼,或者切换开心、放松、惊讶等表情。

也可以选择文字输入,等她回应;准备好后,再主动打开麦克风。默认静音、主动授权、云端实时处理和原型阶段不保存原始录音的设计,让每一次开口都由你决定。

现在打开「数伴」,你会看到什么

  1. 一个有房间、有灯光、有呼吸感的 3D 晚晴。
  2. 一段可以打字或实时语音进行的对话。
  3. 与语义相关的口型、表情和身体动作。
  4. 一组可以直接触发的动作与表情互动。
  5. 连接不稳定时的重试、字幕和麦克风设置。

它还不是一个完成形态的"万能 AI",也不会假装自己已经拥有无限记忆。但它已经足够让你看见一件事:

数字人的成长,不只是模型参数变大,而是从"能回答"走向"会陪伴"。

这一次,养成的不是一个"功能",而是一段关系

我们希望晚晴以后能记住更多重要的事,理解更长的上下文,拥有更丰富的动作和更细腻的情绪反馈。

但在那之前,她先要学会一件最重要的事:当你来到这里时,认真听你说话。

如果你对 3D 数字人、AI 陪伴或实时语音交互感兴趣,欢迎来看看「数伴」的代码,亲手和晚晴见一面。

相关推荐
3D小将1 小时前
3D格式转换之Rhino转换为IGS格式技术
3d·stp模型·igs模型·glb模型
PhotonixBay12 小时前
InGaAs微透镜3D形貌怎么测?共聚焦显微镜在光通信的应用实践
功能测试·测试工具·3d·测试标准
学习星球15 小时前
AI 一句话生成 3D 游戏世界:腾讯 HY-World 2.0 开源深度解析与本地实战
开发语言·人工智能·游戏·3d·ai·课程设计·ai编程
ai小陈1 天前
Hunyuan3D-2云端部署实战:图生3D、文生3D怎么跑更稳
人工智能·科技·3d·ai·音视频·gpu算力
独立开发之道1 天前
Three.js 创建 VR 内容:四步把一个普通 3D 场景送进头显
javascript·3d·vr
人工智能研究所1 天前
手机随手拍一段视频,AI 能还原出一个可以 360° 旋转视角的“数字人“
人工智能·科技·ai·数字人
k4m7v2pz2 天前
Bevy 0.18.1 雨雪天气粒子系统排障实录:四个“想当然“如何让 3D/2D 粒子全部不可见
3d·游戏开发·3d渲染·bevy·天气粒子·2d渲染
戴西软件2 天前
戴西iDWS.3DViz Suite数据轻量化可视化软件,从传统桌面软件向云端协同的重大突破
大数据·运维·网络·人工智能·机器学习·3d
Jmyd01232 天前
实训室的 3D 模型涉及肖像文物,数据安全与合规怎么做?
安全·3d·数据安全·虚拟实训
AI视觉网奇3 天前
3d子部件高亮选中
开发语言·javascript·3d