知识卡片
LZ77 与 LZ78:滑动窗口 vs 短语表的取舍
内容
两大自适应字典压缩流派对”字典从哪来”给出不同答案。LZ77把已解码全部文本当作字典,允许指针指向窗口内任意位置的任意子串,实现简单、速度快,但同一子串可能被反复以不同方式指向,存在编码冗余。LZ78限制只能引用之前已正式识别出的短语(构成一棵短语树),代价是树本身要占内存且不断增长,但避免重复编码浪费。LZ77选择不限制以换速度,LZ78选择限制以换更紧凑表示,其变体LZW后来居上。
参考来源
- 位置:第2章《文本压缩》「自适应字典编码器的LZ77系列」小节(源文件:_chapter-text/ch02.txt)
- 结论依据:原文说明LZ77把已解码全部文本当作字典、实现简单速度快,LZ78限制只能引用已识别短语树,直接支持卡片对两者取舍的论述。
- 原始内容:"所有的自适应字典压缩方法都把20世纪70年代由Ziv和Lempel发展起来的两种方法中的一种作为基础……分别标记为LZ77和LZ78……LZ77及其后续者的一个主要的特征就是实现起来相对容易,仅仅开销很少的内存就能快速地执行解码运算。"