跳到主内容
快讯直播
AI智模界
AI 词典

空间视频:给视频多一个"可以走动的空间

一句话:Spatial Video(空间视频)是带着三维空间信息的视频——它记录或生成的不只是某个机位看到的画面,而是一个你可以在里面小幅挪动、甚至自由换机位的场景。时间在走,观察位置也能变。

为什么难:普通视频(2D video)本质是"一叠照片按时间播放",摄像机替你做完了所有取景决定。空间视频要额外回答一个问题:往旁边站一步,应该看到什么?这要求模型知道画面里每个东西的远近、遮挡关系,以及被挡住的部分长什么样。

打个比方:普通视频像坐在剧院二楼固定座位看戏,角度永远不变;空间视频像拿到一张后台通行证,能上台绕着演员走两步,侧脸、背影都对得上;3D 重建(3D reconstruction)则像把整座剧院扫描成一份模型图纸。

和相邻概念的区别

  • 与 2D 视频:2D 是"一个视角 × 一段时间",空间视频是"一片视角 × 一段时间"。
  • 与 3D 重建:重建靠多角度拍摄(摄影测量、NeRF、3D Gaussian Splatting 等)算出一个三维场景,产物偏"资产",重、要采集、渲染慢;空间视频更强调能拍、能播、能看,追求实时与观看体验,两者常配合使用。
  • 与立体视频(stereoscopic 3D):立体只给左右眼两路画面,有纵深但视角基本固定,属于空间视频光谱上最浅的一档。

为什么最近又热:一是空间计算设备给了"换视角"一个播放终端;二是生成式 AI。过去 AI 视频最大的破绽是空间不一致——镜头一绕,人物衣服换了、桌上杯子挪了位。近期一些新发布的视频生成模型(如 Vidu S2)开始把"空间视频""多视角一致"当卖点:一句提示词生成同一场景里镜头自由移动、甚至多机位的片段。具体支持的时长、分辨率与输入形式,以官方页面为准。

视角自由度数据来源典型用途
2D 视频固定单机位拍摄或生成影视、短视频
立体视频轻微视差双目拍摄头显观影
3D 重建自由但非实时多角度采集+计算测绘、数字孪生
生成式空间视频可运镜、多视角生成模型直接产出广告、短剧、电商、XR

对从业者的意义:视频素材的"维度"变了。以前一条片子就是一个文件、一条时间线;以后可能是"一条时间线 × 一个可探索空间"——剪辑工具要能切视角,素材库要能按空间检索,广告主一条素材能出多机位版本。对普通人来说,最直观的变化是回看比赛、演唱会,或者在线看房看车时,视角由你自己选,而不由导播决定。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。