香港中文大学与腾讯提出CubeComposer,普通相机视频自回归生成4K全景视频
查看引用/信息源请点击:IntelligentOptics
4K全景视频
(映维网Nweon 2026年08月10日)根据Intelligent Optics,香港中文大学与腾讯联合提出了CubeComposer,其核心思路不是一次性生成完整的高分辨率全景视频,而是将360°视频分解为六个cubemap面,沿时间窗口与空间面片逐步生成(spatio-temporal autoregression),从而在可控的计算开销下,首次实现了无需后处理超分的原生4K全景视频生成。

大多数的日常视频拍摄似乎默认了一个规则:镜头朝哪儿,世界就只到哪儿。身后的动静、头顶的光、脚下的纹理,它们和画面里的一切同时发生,却不会出现在录像里。这就是透视视频到360°全景视频生成(perspective-to-360 video generation)所要解决的问题:从一段有限视角的普通视频,重建完整球面的全景空间视频。目前已有方法通常受限于标准视频扩散模型的全注意力计算开销,生成的全景视频分辨率大多停留在 1K(1024×512)左右,而 VR 沉浸式体验需要的分辨率通常是 4K(3840×1920)甚至更高。虽然可以用额外的超分辨率模块提升,但依旧无法真正补充未观测区域的几何结构、外观纹理和运动信息。
鉴于此,香港中文大学与腾讯联合提出了CubeComposer。
......(全文 1611 字,剩余 1243 字)


