来源书籍
新一代高效视频编码H.265HEVC:原理、标准与实现
音视频编码标准类
类别清单覆盖
9/9
已覆盖 9
补充生成 0
未覆盖 0
全书概览
新一代高效视频编码H.265/HEVC:原理、标准与实现
Skill 版本:v1
类别:音视频编码标准类
四象限结论:工程实践(高浓度 + 低稳定性)
评级理由: - 信息浓度:高。全书不满足于罗列语法字段,而是大量推导”为什么”——第8章从信息论的熵定义、香农第一定理一路推导到算术编码原理;第11章从互信息量推导率失真函数;第5、6章分别讲清DCT/DST和标量量化(含Lloyd-Max量化器)的数学基础;第3、9章解释了为什么要把VPS/SPS/PPS分层、为什么NAL要分VCL/non-VCL、IRAP/IDR/CRA/BLA之间的设计取舍。这些都是”讲原理/权衡”而非单纯”讲步骤”。 - 稳定性:低。前言与全书结构均明确说明每个模块按”背景知识 + 语法语义 + 实现方式”三段展开,其中大量篇幅(参数集具体字段、NALU头具体比特布局、CTU/PU/TU的具体尺寸范围、HM参考软件的具体RDO实现)绑定在 H.265/HEVC 这一具体标准版本上。H.265 发布于2013年,已被 H.266/VVC 取代,这部分内容会随标准演进而过时,不同于”讲透即可跨版本适用”的原理书。 - 综合:高浓度 + 低稳定性 → 工程实践。
章节进度追踪表
| 章节号 | 章节标题 | 精读/略读 | 状态 | 卡片数 |
|---|---|---|---|---|
| 前言/简介 | 内容简介、前言 | 略读 | done | 0 |
| ch01 | 第1章 绪论 | 精读 | done | 6 |
| ch02 | 第2章 数字视频格式 | 精读 | done | 4 |
| ch03 | 第3章 编码结构 | 精读 | done | 4 |
| ch04 | 第4章 预测编码 | 精读 | done | 7 |
| ch05 | 第5章 变换编码 | 精读 | done | 4 |
| ch06 | 第6章 量化 | 精读 | done | 4 |
| ch07 | 第7章 环路后处理 | 精读 | done | 3 |
| ch08 | 第8章 熵编码 | 精读 | done | 6 |
| ch09 | 第9章 网络适配层 | 精读 | done | 4 |
| ch10 | 第10章 编解码并行处理 | 精读 | done | 5 |
| ch11 | 第11章 率失真优化 | 精读 | done | 4 |
| ch12 | 第12章 速率控制 | 精读 | done | 2 |
| appA | 附录A 术语及英文解释 | 略读 | done | 0 |
| appB | 附录B 缩写 | 略读 | done | 0 |
章节标记理由: - 前言/简介:纯出版说明,无实质内容。 - 第1~12章:均命中”概念类内容强制生卡”规则(视频压缩基本概念、色彩感知与色度采样原理、GOP/CTU/参数集分层设计、预测/变换/量化/熵编码/滤波/并行/率失真/速率控制的原理与权衡),硬性标记精读;各章内部的纯语法字段列举/HM实现细节按信息浓度过滤,不逐条生卡。 - 附录A/B:术语表和缩写表,纯参考速查内容,无原理讲解,略读。
待关联术语
| 术语名 | 出现章节 | 一句话语境 |
|---|---|---|
| AVS/AVS+/AVS2 | ch01 | 中国自主知识产权的视频编码标准,仅提及标准化时间线,未展开技术细节 |
| Golomb-Rice码、Hybrid-Golomb码 | ch08 | 与指数哥伦布码同属规则结构变长码家族,仅提及名字未展开原理 |
引用文献
| 标题 | 类型 | 出现章节 | 一句话语境 |
|---|---|---|---|
| LOCO-I算法(JPEG-LS) | 框架/算法 | ch04 | 早期基于加权平均邻近像素的帧内预测方法,书中仅一句话带过未展开 |
| WMV9去振铃滤波器 | 框架 | ch07 | 早于SAO的振铃效应抑制方案,将像素分为边缘/非边缘两类分别滤波,书中简述后未深入 |
实践卡进度
| 序号 | 实践标题 | 实践方式 | 状态 | 关联章节 | 产出 |
|---|---|---|---|---|---|
| 1 | 用x265编码日志观察CTU四叉树分割的真实统计 | 实现深读 | done | CTU分割相关章节 | 平坦/复杂片段CU分布对比表 |
| 2 | 开关SAO滤波实测振铃效应抑制的真实画质与码率影响 | 实现深读 | done | SAO滤波相关章节 | PSNR/SSIM数值与截图对比 |
类别清单核对(音视频编码标准类)
| 维度 | 覆盖状态 | 关联卡片标题或未覆盖理由 |
|---|---|---|
| 编码框架/流水线设计 | 已覆盖 | 《混合编码框架的模块拼接逻辑》(ch01) |
| 分块/分割结构 | 已覆盖 | 《四叉树分割体系替代固定宏块》(ch01)、《Tile与Slice分别面向并行和容错》(ch03)、《非对称预测分割贴合真实物体边界》(ch03) |
| 预测技术(帧内/帧间) | 已覆盖 | 《基于块的运动表示是精度与开销的折中》《B帧双向预测解决遮挡带来的不可预测运动》《预测模式本身也要被预测编码》《时域运动矢量预测需按帧距比例缩放》(均ch04) |
| 变换与量化原理 | 已覆盖 | 《DCT是K-L变换在工程上的实用近似》《变换基函数要匹配残差的统计特性》(ch05);《最优量化器的两个不动点条件》《量化区间宽度应该按后续熵编码代价来设计》《量化参数用对数标度覆盖巨大的步长动态范围》(ch06) |
| 熵编码机制 | 已覆盖 | 《熵是无失真压缩码长的理论下界》《算术编码突破变长码单符号一比特的下限》《常规与旁路两种模式只为真正需要建模的符号花成本》《符号数据隐藏把一比特信息编码进奇偶性里》(均ch08) |
| 环路滤波/后处理 | 已覆盖 | 《方块效应源于块独立编码的误差不连续》《滤波强弱决策要避免误伤真实纹理》《SAO在像素域而非频域解决振铃效应》(均ch07) |
| 率失真优化理论 | 已覆盖 | 《最优预测模式看率失真代价而非残差大小》(ch04);《率失真函数是有失真压缩的理论下界》《拉格朗日乘子把全局码率约束拆成局部独立决策》《拉格朗日优化触达不到凸包络内部的更优点》(ch11) |
| 并行处理/网络适配设计 | 已覆盖 | 《NAL让网络层无需理解编码语义就能优化传输》(ch09);《功能并行与数据并行的取舍》《波前并行用错位滞后换取不牺牲压缩效率的并行》(ch10) |
| 与前代标准的对比与演进 | 已覆盖 | 《四叉树分割体系替代固定宏块》(ch01)、《整数化变换消除编解码端的浮点失配》(ch05)、《三种IRAP图像是压缩效率与随机接入能力的分级折中》(ch09) 等多张卡片均以H.264/AVC为对照说明H.265/HEVC的演进取舍 |
章节与卡片
01 绪论
- 有损压缩为何是视频编码的必然选择 普通读书笔记卡
- 视频编码标准只约束解码不约束编码 普通读书笔记卡
- 混合编码框架的模块拼接逻辑 普通读书笔记卡
- 四叉树分割体系替代固定宏块 普通读书笔记卡
- 自适应变换划分的能量集中与细节保留权衡 普通读书笔记卡
- IBDI用位深换预测精度的代价 普通读书笔记卡
02 数字视频格式
- 三基色原理是彩色数字化的生理基础 普通读书笔记卡
- 亮度色度分离为色度亚采样铺路 普通读书笔记卡
- 量化深度需匹配人眼动态范围而非成像设备 普通读书笔记卡
- 隔行扫描用空间分辨率换时间流畅度 普通读书笔记卡
03 编码结构
- 参数集分层是为了消除重复传输的冗余 普通读书笔记卡
- Tile与Slice分别面向并行和容错 普通读书笔记卡
- 非对称预测分割贴合真实物体边界 普通读书笔记卡
- 档次与层级是正交的两种能力约束 普通读书笔记卡
04 预测编码
- 最优预测模式看率失真代价而非残差大小 普通读书笔记卡
- 基于块的运动表示是精度与开销的折中 普通读书笔记卡
- 快速搜索算法用局部最优换速度 普通读书笔记卡
- 亚像素运动估计精度存在收益拐点 普通读书笔记卡
- B帧双向预测解决遮挡带来的不可预测运动 普通读书笔记卡
- 预测模式本身也要被预测编码 普通读书笔记卡
- 时域运动矢量预测需按帧距比例缩放 普通读书笔记卡
05 变换编码
- DCT是K-L变换在工程上的实用近似 普通读书笔记卡
- 整数化变换消除编解码端的浮点失配 普通读书笔记卡
- 变换基函数要匹配残差的统计特性 普通读书笔记卡
- 用低复杂度变换近似估算代价加速模式决策 普通读书笔记卡
06 量化
- 最优量化器的两个不动点条件 普通读书笔记卡
- 量化区间宽度应该按后续熵编码代价来设计 普通读书笔记卡
- 量化参数用对数标度覆盖巨大的步长动态范围 普通读书笔记卡
- RDOQ把量化决策扩展到整组系数与结构信息 普通读书笔记卡
07 环路后处理
- 方块效应源于块独立编码的误差不连续 普通读书笔记卡
- 滤波强弱决策要避免误伤真实纹理 普通读书笔记卡
- SAO在像素域而非频域解决振铃效应 普通读书笔记卡
08 熵编码
- 熵是无失真压缩码长的理论下界 普通读书笔记卡
- 哈夫曼最优码字换不来规则的解码结构 普通读书笔记卡
- 算术编码突破变长码单符号一比特的下限 普通读书笔记卡
- 常规与旁路两种模式只为真正需要建模的符号花成本 普通读书笔记卡
- 上下文建模资源要按贡献大小分配 普通读书笔记卡
- 符号数据隐藏把一比特信息编码进奇偶性里 普通读书笔记卡
09 网络适配层
- NAL让网络层无需理解编码语义就能优化传输 普通读书笔记卡
- 三种IRAP图像是压缩效率与随机接入能力的分级折中 普通读书笔记卡
- 时域分级让码流可以不解码直接降帧率 普通读书笔记卡
- 字节填充避免载荷数据与帧起始码冲突 普通读书笔记卡
10 编解码并行处理
- 功能并行与数据并行的取舍 普通读书笔记卡
- 波前并行用错位滞后换取不牺牲压缩效率的并行 普通读书笔记卡
- Tile划分同时解锁并行与降低参考缓存 普通读书笔记卡
- 并行粒度越细负载越均衡但吞吐越不稳定 普通读书笔记卡
- 重叠波前并行让空闲线程提前跨帧接活 普通读书笔记卡
11 率失真优化
- 率失真函数是有失真压缩的理论下界 普通读书笔记卡
- 拉格朗日乘子把全局码率约束拆成局部独立决策 普通读书笔记卡
- 拉格朗日优化触达不到凸包络内部的更优点 普通读书笔记卡
- 提前终止策略用强信号跳过穷举搜索的剩余分支 普通读书笔记卡
12 速率控制
- 缓冲区用延迟换取速率平滑 普通读书笔记卡
- 比特预算按GOP到宏块逐级递归分解 普通读书笔记卡
相关主题
暂无公开主题。