知识卡片
标记语言用标签分离内容与呈现/语义
内容
HTML 通过在文本中插入标签来描述这段内容该如何显示(该用什么标题级别、是否链接到别处),本质是把”排版指示”和”正文内容”编码进同一份文本文件里;XML 把这种”用标签标注结构”的思路抽象成一套通用标准,允许为任何领域(乐谱、数学公式)设计专属的标记语言,而不必每个领域各自发明一套不兼容的编码体系。更进一步的区别在于标注的是什么:HTML 标签大多描述外观(如何显示),而按语义设计的标签(如把菜谱配料标为 <ingredient> 而非仅仅是列表项)描述的是内容的含义,这使得搜索引擎能理解”这道菜不含菠菜”,而不只是匹配字面词语。发散:这是”表现层”和”语义层”分离的雏形——一份内容一旦被赋予了明确的语义标注,就能被机器可靠地理解和处理,而不必依赖它恰好长什么样子,这个理念后来演化成了结构化数据、Schema.org 标记乃至语义网的整套设想。
参考来源
《计算机科学概论》第4章《组网及因特网》