六自由度(6 Degrees of Freedom,简称6DoF)视频技术,代表了沉浸式媒体领域的最新演进方向。它让用户在观看视频时,不仅能够站在原地通过头部转动与内容进行交互(即3自由度),还能借助身体移动来改变观察位置,从不同角度审视场景(额外3自由度)。这项技术彻底颠覆了传统视频的被动观看模式,让用户真正“步入”视频世界。本文将从内容采集与预处理、编码压缩与传输优化、以及交互与呈现三大核心环节,带您全面了解6DoF视频的完整技术链条。
一、6DoF内容采集与预处理
6DoF视频以三维场景为观察对象,其核心挑战在于如何高效获取真实世界的三维视觉信息。单台相机只能捕捉二维图像,要获得深度信息,必须采用专门的采集方案。目前主要分为多视点联合采集和多视点与深度联合采集两大技术方向。
1.1 多视点联合采集
借鉴人眼双目视觉原理,使用两台以上相机同步拍摄,即可通过立体匹配算法计算深度信息。根据相机排列方式,主要有以下几种典型几何排布模式:
- 平行模式:相机呈直线排列,光轴彼此平行。各视点间图像无垂直偏移,交互体现为水平方向移动。
- 发散模式:所有相机光轴的延长线交于同一点(共心)。这种方式适合生成全景视频,常用于3自由度交互应用。
- 汇聚模式:相机直线排列,但光轴汇聚于一点。交互表现为带有弧度的水平移动,然而在实际操作中,汇聚点确定和几何标定等问题较为棘手。
- 围绕模式:相机可呈半球体或球体布局,支持720°自由交互。华中科技大学团队通过视点传递方法,成功解决了环绕和球面相机阵列的几何标定难题。
- 平面模式:在平行模式基础上扩展为二维平面分布,逐步演化为光场采集系统和亿像素采集系统。
