知识卡片

全文检索与传统数据库的根本差异

普通读书笔记卡 · 1223.e

内容

传统数据库靠一小部分预先选定的键(如账号)定位记录,查询能力被限定在建索引时设计好的字段范围内。全文检索把记录的每个组成部分都当作可查询的键——任何词都可能是未来查询的入口,这是理念上的根本区别,而非只是”索引更多字段”。这解释了为什么全文检索常面对设计时完全无法预见的查询组合,也是全文索引规模远大于传统数据库索引的原因。

参考来源

- 位置:第1章《概览》1.5节前导论述(源文件:_epub-src/OEBPS/text00007.html) - 结论依据:原文用航空公司数据库“account number”预选键与全文检索“每个部分都是被索引的”对比,并举了“同一天出发去机场的人”这一无法预见的查询例子,与卡片描述的根本差异及例子高度吻合。 - 原始内容:"传统数据库存放的数据是通过一小部分预先选择的键(preselected keys)来获取的。例如,“account number”……一个全文检索系统中记录的每个部分都是被索引的,因此任何一个部分都可以用来查询。假设你要想搭个便车去机场,可能需要从一个航空公司的数据库中抽取(extract)出一份你所在街道并和你同一天出发的人员名单。"