知识卡片
基于块的运动表示是精度与开销的折中
内容
描述视频中物体运动有三种粒度:逐像素运动矢量最精确但每个像素都要传一个MV,开销大且难以求解;按分割出的运动物体区域描述最符合物理直觉,但区域分割本身计算量大、边界不规则难以高效编码;按固定形状的块描述则牺牲了运动边界的精确性,换来了运动参数可独立且低成本地估计和编码。几乎所有主流视频编码标准最终选择了基于块的运动表示法,这不是因为它最准确,而是因为它在”表达精度”和”求解与编码成本”之间取得了工程上可接受的折中——这也是为什么后续标准不断在”块”这个基本单位上做文章(可变块大小、非对称划分),而不是抛弃分块本身去追求逐像素或逐区域的运动描述。
参考来源
《新一代高效视频编码H.265/HEVC:原理、标准与实现》第4章《预测编码》