知识卡片
最优预测模式看率失真代价而非残差大小
内容
在为一个块选择帧内预测模式或运动矢量时,编码器并不是单纯挑选让残差最小的那个选项,而是为每个候选计算拉格朗日代价 J=D+λ·R,其中D是重建失真、R是把这个选择本身(模式编号、运动矢量、划分方式等)编码所需的比特数,λ是权衡二者的拉格朗日因子。这是因为残差最小的模式往往需要更精细的划分或更复杂的模式来达成,而这些”侧信息”本身也要占用码流的比特预算;只优化D会让R失控。这本质上是把”最小化失真”这个单目标问题,转化成”失真+代价”的加权和去逼近帕累托最优解,是率失真优化贯穿视频编码几乎每一个决策点(模式选择、块划分、运动搜索)的通用范式。
参考来源
《新一代高效视频编码H.265/HEVC:原理、标准与实现》第4章《预测编码》