游乐游手机版
首页/AI热点日报/热点详情

智汇云舟推出视频驱动实时3D人体姿态重建技术升级

类型:热点整理2026-08-20
在智汇云舟的视频孪生体系中,“人”始终是最核心、也最难精准还原的一类关键要素。过去,在传统视频监控场景中,人往往只是二维画面中的一组像素——虽然能够被看见,却很难被真正“读懂”:他在哪里?他正在做什么?他的体型、姿态和动作意图是什么?跨镜头切换之后又该如何实现连续追踪?这些问题在二维视频分析中始终存

在智汇云舟的视频孪生体系中,“人”始终是最核心、也最难精准还原的一类关键要素。

技术再进阶!智汇云舟推出视频驱动实时3D人体姿态重建技术

过去,在传统视频监控场景中,人往往只是二维画面中的一组像素——虽然能够被看见,却很难被真正“读懂”:他在哪里?他正在做什么?他的体型、姿态和动作意图是什么?跨镜头切换之后又该如何实现连续追踪?这些问题在二维视频分析中始终存在明显瓶颈。

现在,一个重磅好消息来了。近日,智汇云舟实现关键技术突破,正式推出视频驱动实时三维人体姿态重建(3D Human Pose Reconstruction)技术。依托这项能力,仅凭普通RGB摄像机采集的视频画面,系统就能对画面中的人体进行实时拟合,在三维空间中直接还原对应的3D人体模型,同时较为精准地拟合2D画面中人物的体态特征,例如高矮、胖瘦等,以及对应的人体姿态。

结合此前已经发布的相机自动配准技术,“实景孪生”正在从“还原空间”进一步迈向“还原人”,让“所见即所得”真正落到每一个具体个体身上。

能力说明

1. 一台普通RGB摄像机,即可“还原一个人”

无需深度相机,无需红外补光,无需被识别者穿戴任何设备,也无需提前在场景内布设专用标定物。只要接入普通监控摄像机的视频流,系统就能够实时检测画面中的人体,并在三维空间内重建出完整的3D人体模型。这意味着,海量已建成的监控摄像头无需更换硬件,就能快速升级为“三维人体感知终端”,显著提升现有视频监控系统的应用价值。

2. 不只是姿态,更是“体态”

以往的视频智能分析通常只能识别“动作类别”,却难以回答“这个人长什么样、有多高、偏瘦还是偏壮”等更细致的问题。该项能力在重建人体姿态的同时,还能进一步对人体身高、肩宽、胖瘦等体态参数进行回归拟合,让3D人体与2D画面中的真实人物实现更高程度对应。比如,画面中那位身形偏瘦、抬手示意的工作人员;又或者那位体型偏壮、正在缓步前行的访客——都能在三维场景中以接近真实的体态被还原呈现。

3. 实时、多人、跨镜头持续跟踪

实时性:处理时延可控制在视频流可用的工程范围内,能够满足在线指挥、实时预警、即时告警等强实时业务场景;

多人并发:支持单路视频画面中多人同时拟合,彼此之间互不干扰;

跨镜头持续跟踪:当人员离开一个镜头并进入另一个镜头后,3D人体的身份与姿态信息仍可持续维护,避免出现“一出画面就丢失”的情况。

4. 与3DGS实景空间无缝融合

重建得到的3D人体不再是悬浮于黑色背景中的孤立骨架,而是被精准“放入”由3DGS(3D高斯泼溅)技术重建的高保真实景三维空间中——人可以站在地板上、绕过桌椅、穿过走廊,并与场景几何严格对齐。配合前序相机自动配准能力,任意一路普通摄像机接入后,都可自动完成相机参数求解,真正实现免标定、即接即用。

技术原理

视频驱动的实时3D人体姿态重建,本质上是在解决一个关键难题:如何从一张2D图像反推出3D空间中的人体状态。这是一个典型的“病态逆问题”——由于2D像素天然丢失深度信息,同一个2D投影往往可能对应多种不同的3D姿态。智汇云舟的工程实现路径大致可以概括为四个步骤:

步骤一:2D人体感知

系统对视频流逐帧执行人体检测与2D关键点提取,定位头部、肩、肘、腕、髋、膝、踝等核心骨骼节点。这一步的作用,是将画面中的“人”从背景信息中有效解耦出来,形成结构化的2D人体骨架表示,为后续3D人体重建打下基础。

步骤二:3D姿态反向解算

基于2D骨架结果以及人体运动学约束,系统反向求解3D关节角度。与此同时,引入人体参数化模型作为先验——该模型通过少量参数即可描述标准人体的形状与姿态,既能有效约束求解空间,避免出现“反关节”等不合理姿势,也能通过体型参数的逐帧回归拟合,如身高、肩宽、胖瘦等,重建出与2D画面中真人体态相对应的3D人体模型。

步骤三:时序一致性约束

单帧重建容易出现抖动和跳变,因此系统在时间维度上施加平滑约束,使其对短时遮挡、运动模糊以及画面抖动具备一定鲁棒性。当人物短暂被遮挡后再次出现时,姿态信息能够实现平滑衔接,避免出现“瞬移”或“重置”等不自然现象。

步骤四:实景空间锚定

依托此前发布的相机自动配准技术,每一路摄像机在接入实景三维场景时,系统都能够自动求解出准确的内外参数。随后,系统将2D像素坐标准确映射到3DGS实景空间的世界坐标系中,使重建得到的3D人体精确落位到真实空间的对应位置,实现“不仅姿态正确,位置也准确”。

工程闭环

整个流程在视频孪生能力平台上以“视频流输入 → 实时拟合 → 3D人体输出 → 实景空间叠加”的方式构成完整闭环,并与平台现有能力,如人脸识别、ReID行人重识别、人体属性识别、AI事件识别、IOT物联数据等天然打通,共同组成统一的“视频孪生 + 人体感知”能力底座。

应用场景展示

公安立体侦查与防控场景

系统可将视频画面中的重点人员实时重建为3D人体,并精准映射到实景三维场景中。指挥人员不再需要在多个二维监控画面之间反复切换并脑补空间位置关系,人物所在位置、当前姿态和动作状态都能一目了然,跨镜头连续追踪也更加自然连贯,重点人员“在哪里、在做什么、与谁接触”都能在一张三维态势图中完整呈现。

各类能源场站场景

在LNG储罐区、变电站、油气场站、新能源电站等各类能源场站中,高危作业分布密集、人员位置分散,现场安全风险较高。借助实时3D人体姿态重建技术,系统能够对作业人员的不安全姿态进行实时识别和告警,例如违规躺卧、攀爬、跨越围栏、跌倒等,并联动电子围栏与三维场景定位能力,在第一时间将告警事件精准关联到具体人员和具体位置,提升安全监管效率。

重大活动安保场景

在大型活动保障期间,现场人员密集、摄像机数量多、监控视角复杂。通过该技术,每位被识别者的3D人体姿态与行动轨迹都能在实景三维场景中实时呈现,既有助于前期预案规划,也便于活动进行中的人员态势精准掌控,让指挥调度能力从“看监控”进一步升级为“看态势”。

智慧园区与楼宇场景

在办公区、生产区等园区与楼宇场景中,人员合规监管需求十分常见:是否佩戴安全帽、是否按规定路线行走、是否进入授权区域、是否长时间滞留等,都可以在三维场景中通过“姿态+位置+时间”三要素进行精准研判,帮助管理者摆脱“画面里看不清、监控里找不到”的难题。

应急救援与现场指挥场景

在突发事件现场,第一视角视频往往信息繁杂、现场态势混乱。3D人体姿态重建技术能够将现场人员的位置与动作状态,如救援、疏散、被困、伤员姿态等,在实景三维场景中直观还原,为远程指挥提供更接近所见即所得的态势感知能力,辅助快速研判与科学决策。

从二维像素,到三维人体;从“看得见”,到“看得清”;从“看得清”,到“看得懂”。

视频驱动的实时3D人体姿态重建技术,是智汇云舟在视频孪生核心能力上的又一次重要突破,也是“以实展实、以实代虚”理念的再次落地。它让视频孪生空间中的“人”不再只是抽象图标或模糊像素,而是一个具备姿态、体态、行为和空间位置的“真实存在”。

未来,智汇云舟将继续以视频孪生为核心能力,让物理世界在数字空间中实现更真实、更实时、更立体的还原,让每一次看见,都更接近真相。

来源:https://www.eefocus.com/article/2069272.html

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。