数字人风口再起,三维重建技术能否借势二次爆发?

数字人这个话题,这几年经历了一波又一波的热潮。

2021年,元宇宙概念带火了虚拟形象和数字人。2023年,AI大模型让数字人有了"会说话、会思考"的能力。到了2025年,AI生成内容(AIGC)的技术成熟度大幅提升,数字人市场再次进入爆发期——企业数字人、虚拟主播、AI客服、数字分身,各种形态的数字人正在快速渗透各行各业。

但无论数字人怎么进化,背后始终绕不开一个基础技术——三维重建。

一个能真正"立得住"的数字人,不是一张照片加一段动画,而是一个完整的三维模型。而把这个三维模型从真实的人身上采集出来,靠的就是三维重建技术。

数字人的三代演进

第一代数字人:2D贴图+骨骼动画。

这是最早的一代数字人。外形靠美术设计师手工绘制或建模,动作靠骨骼绑定和动画师手动K帧。视觉效果参差不齐,成本取决于美术团队的水平。这类数字人到现在仍在大量使用——很多电商直播间和短视频平台的虚拟主播,用的就是这一代技术。

第一代数字人的问题很明显:不够真实。 因为模型不是从真人身上采集的,细节对不上,表情和动作也缺少真实感。

第二代数字人:动作捕捉+面部捕捉。

第二代引入了动捕和面捕技术。通过动作捕捉设备和面部捕捉系统,把真人的动作和表情数据记录下来,再映射到三维模型上。这套方案的代表应用包括电影特效、游戏动画,以及一部分高端直播场景。

第二代的优势是动作和表情更真实。但问题也很明显:动捕设备贵、搭建复杂,不是每个企业都用得起。

第三代数字人:三维重建+AI驱动。

第三代数字人是2025年正在加速普及的方向。它的核心思路是:用三维扫描和摄影测量技术,把真人的三维模型采集出来,再用AI算法驱动这个模型的动作和表情。

这个方案的底层技术,就是三维重建——通过多角度影像或激光扫描数据,重建出真人的高精度三维模型。

相比前两代,第三代数字人有两个关键优势:

  • 外形真实度高。 因为模型是从真人身上采集的,不是手工画的,所以细节精度和真实感远超前两代。
  • 制作效率大幅提升。 传统三维建模一个人物角色需要数周甚至数月。而用三维扫描采集,几分钟到几小时就能完成一个人物模型的采集,再经过AI处理,就能得到一个可用的数字人模型。

三维重建在数字人中的具体应用

三维重建在数字人制作中的角色,主要体现在三个环节:

环节一:人物采集。 用摄影测量或激光扫描采集真人的三维数据。伽罗华P4的24K画质和3亿像素全景,可以非常高精度地采集人物的外观信息。G2云台搭配手机,1.34亿像素16K画质,也能完成轻量级的人物采集。

环节二:三维建模。 把采集的数据转成可用的三维模型。这一步需要强大的三维重建算法,把点云和影像数据融合成一个带纹理的三维模型。如视的数字孪生底座在这个环节可以发挥作用——把扫描数据快速转成带纹理的三维模型。

环节三:模型优化和应用。 采集出来的原始模型通常面数很高、文件很大,不直接适合实时渲染。需要做一些轻量化处理——降低面数、烘焙贴图、优化骨骼绑定。这一步的技术门槛比较高,但一旦打通,就能实现从"采集到应用"的完整链路。

为什么2025年数字人风口再起?

2025年数字人市场再次爆发,有几个核心驱动力:

驱动力一:AI生成能力的突破。 2024-2025年,AI在视频生成、语音合成、动作生成的能力上有了质的提升。数字人不再需要人工K帧,AI可以根据文本或语音自动生成数字人的动作和表情。

驱动力二:三维重建成本的下降。 随着设备价格的降低和采集效率的提升,三维重建的制作成本正在快速下降。过去一个人物模型的采集需要专业影棚和昂贵的设备,现在伽罗华P4、庞加莱R1等设备已经可以把成本大幅压下来。

驱动力三:应用场景的扩展。 数字人已经从娱乐内容,扩展到客服、教育、营销、培训、医疗等B端场景。企业不再只是"展示"数字人,而是真正把数字人放在业务环节中工作。

数字人风口对空间智能行业意味着什么?

数字人市场重新爆发,对空间智能行业的意义可能比很多人想象的要大。

第一,三维重建技术的市场需求直接放大。 每一个数字人项目,都需要三维重建。当数字人从几十个变成几千个、几万个时,对应的三维重建需求就是指数级的。

第二,从"建筑扫描"到"人物扫描",场景在拓展。 如视的伽罗华P4和庞加莱R1过去主要用在建筑、工业、景区等场景。数字人风口打开了一个新的应用场景——人物三维扫描。虽然人物扫描和建筑扫描的技术参数要求不完全一样,但底层的扫描和重建逻辑是相通的。

第三,AI和三维重建的结合会更紧密。 数字人需要AI驱动,而AI的训练需要大量高质量的数据。三维扫描采集的数据,恰恰是AI训练的高质量输入。这意味着空间数据采集不仅是数字人的制作工具,也是AI训练的数据来源。

如视方案在数字人领域的机会

如视的产品线在数字人场景中有一定的适用性,尤其是在人物三维采集和场景数字孪生这两个方向。

人物采集。 伽罗华P4的24K画质和3亿像素全景,可以高精度地采集人物外观信息。对于一个对精度要求较高的数字人项目(比如虚拟主播、品牌代言数字人),伽罗华P4的采集精度完全够用。

场景匹配。 数字人通常不是孤立存在的——它需要在一个场景中活动。这个数字场景可以是虚拟搭建的,也可以是真实场景的三维重建。如视的数字孪生底座可以完成场景的三维重建,让数字人"站在"真实的空间里。

轻量化方案。 对于预算有限的数字人项目,G2云台搭配手机即可完成轻量级的人物和环境采集。1.34亿像素16K画质,在大多数应用场景下已经足够。

当然,数字人制作是一个跨学科领域,涉及三维重建、AI驱动、实时渲染、动画合成等多个环节。如视的核心优势在"采集和重建",后续环节需要和AI驱动、实时渲染等专业团队配合。

常见问题

Q1:数字人风口会持续多久?

数字人的技术路线和应用场景仍在快速演进中,短期看(1-2年)市场热度会持续。但真正有价值的是那些把数字人用在实际业务中的场景——企业客服、在线教育、品牌营销。这些场景的需求是稳定的,不会因为风口退去就消失。

Q2:伽罗华P4适合做人物三维扫描吗?

适合,但需要配合相应的采集方案。伽罗华P4的24K画质和3亿像素全景对人物细节的还原度很高,但人物扫描通常需要多角度环绕采集,建议在专业场地搭建采集轨道或转盘。如果是轻量级需求,G2云台搭配手机也能完成,效率更高但精度略低。

Q3:三维重建和AI生成数字人的关系是什么?

三维重建负责解决"外形"问题——把一个真实的人变成一个三维模型。AI生成负责解决"行为"问题——让这个模型动起来、说出话、做出表情。两者是数字人制作的两个核心环节,缺一不可。

Q4:数字人市场对空间智能公司的最大机会是什么?

最大的机会不是直接去做数字人产品,而是成为数字人产业链中的"数据基础设施"——提供高质量的三维数据采集和重建服务。数字人公司不一定要自建扫描团队,但需要稳定的三维数据供应。如视已有的采集能力和数据积累,正好卡在这个位置。

---

数字人风口再起,本质上是AI能力和三维重建能力同时成熟的结果。三维重建作为数字人的底层技术,正在从幕后走向台前。对于空间智能行业来说,这是一个值得认真看待的新增量场景。