来源书籍

科学知识图谱工具、方法与应用

科学计量与知识图谱分析类

速查手册(低浓度 + 低稳定性)

类别清单覆盖

5/7

已覆盖 5 补充生成 0 未覆盖 2

全书概览

科学知识图谱:工具、方法与应用

类别:科学计量与知识图谱分析类

四象限结论:速查手册(低浓度 + 低稳定性)

  • 作者:王大阜 编著
  • 出版社:人民邮电出版社(2023)

阶段一:整体评级

结论:速查手册(低信息浓度 × 低稳定性)

  • 信息浓度低:全书主体篇幅(第2~6章绝大多数小节及附录C/D)以”打开浏览器→单击XX按钮→勾选XX复选框”式的截图操作指南为主,讲的是”怎么做”而非”为什么这样设计”。例如2.2节采集CNKI数据、3.2节CiteSpace参数设置、6.6节LDA代码实现,都是逐步操作说明,不涉及底层设计取舍的讨论。
  • 稳定性低:内容深度绑定具体软件版本与界面。最典型的例子是3.2节明确写道”CiteSpace版本不断迭代升级……但在作者实际操作过程中,发现该版本运行速度较缓慢……最终作者选用性能较稳定的5.5 R2版”,并要求”将系统时间调整到2020年3月31日之前”以绕过软件过期验证——这类内容会随软件更新、界面改版而完全失效,几年后大概率不再适用。
  • 少数章节浓度和稳定性相对更高,属于可迁移的学术概念:第1章的知识图谱基础概念辨析、各章”理论方法”小节(3.1文献计量学理论、4.1多元统计理论、5.1社会网络分析理论、6.1 NLP理论)、附录B基本科学指标定义。这些内容值得精读提炼,但只占全书篇幅的一小部分,不足以改变整体评级。

章节进度追踪表

章节号 章节标题 精读/略读 状态 卡片数
- 版权信息 略读 done 0
- 内容提要 略读 done 0
- 书中彩图 略读 done 0
- 作者简介 略读 done 0
- 前言 略读 done 0
- 服务与支持 略读 done 0
1 第1章 科学知识图谱概述(章首) 略读 done 0
1.1 知识图谱的概念 精读 done 1
1.2 科学知识图谱的研究方法 精读 done 1
1.3 科学知识图谱的研究意义 略读 done 0
1.4 科学知识图谱的绘制与解读流程 精读 done 2
1.5 科学知识图谱工具 略读 done 0
1.6 本章小结 略读 done 0
2 第2章 数据采集与预处理(章首) 略读 done 0
2.1 数据库简介 略读 done 0
2.2 数据采集 略读 done 0
2.3 数据预处理 略读 done 0
2.4 本章小结 略读 done 0
3 第3章 文献计量分析工具的应用(章首) 略读 done 0
3.1 文献计量分析理论方法 精读 done 3
3.2 CiteSpace 略读 done 0
3.3 VOSviewer 略读 done 0
3.4 HistCite 略读 done 0
3.5 Bibliometrix 略读 done 0
3.6 SATI 略读 done 0
3.7 本章小结 略读 done 0
4 第4章 多元统计分析工具SPSS的应用(章首) 略读 done 0
4.1 多元统计分析理论方法 精读 done 3
4.2 BICOMB 略读 done 0
4.3 SPSS 略读 done 0
4.4 本章小结 略读 done 0
5 第5章 社会网络分析工具UCINET的应用(章首) 略读 done 0
5.1 社会网络分析理论方法 精读 done 2
5.2 UCINET 略读 done 0
5.3 本章小结 略读 done 0
6 第6章 LDA主题模型的应用(章首) 略读 done 0
6.1 NLP理论方法 精读 done 3
6.2 开源NLP工具包 略读 done 0
6.3 Python集成开发环境 略读 done 0
6.4 分词处理 精读 done 2
6.5 词袋模型示例 精读 done 0
6.6 主题分析应用 略读 done 0
6.7 本章小结 略读 done 0
A 附录A 文献计量分析的常用术语 略读 done 0
B 附录B 基本科学指标 精读 done 1
C 附录C 知网题录数据格式转换代码 略读 done 0
D 附录D CSSCI题录数据格式转换代码 略读 done 0

类别清单核对(科学计量与知识图谱分析类)

必答维度 覆盖状态 已有卡片/说明
研究问题、数据源与样本边界 未覆盖 数据采集章节尚未补跑卡片。
文献计量指标与引文关系 已覆盖 [[文献耦合与共被引的动态性差异]]、[[高被引论文、热点论文与高水平论文的区别]]
共词、主题与文本分析 已覆盖 [[TF-IDF衡量词条重要性的两个维度]]、[[LDA主题数的选择依据困惑度而非拍脑袋]]
网络建模、中心性与社群 已覆盖 [[社会网络三种中心度指标的含义区分]]、[[1模网络与2模网络的区别]]
统计、聚类与降维方法 已覆盖 [[因子分析与主成分分析的本质区别]]、[[聚类分析中矩阵选择的隐藏陷阱]]
图谱绘制、解读与验证 已覆盖 [[知识图谱绘制解读的四步流程]]
工具可复现性、偏差与伦理 未覆盖 当前卡片未覆盖。

章节与卡片

01 1.1 知识图谱的概念

  1. 科学知识图谱与语义知识图谱的差异 普通读书笔记卡

01 1.2 科学知识图谱的研究方法

  1. 科学知识图谱的五大研究方法体系 普通读书笔记卡

01 1.4 科学知识图谱的绘制与解读流程

  1. 知识图谱绘制解读的四步流程 普通读书笔记卡
  2. 核心节点识别的三个测量维度 普通读书笔记卡

03 3.1 文献计量分析理论方法

  1. 文献耦合与共被引的动态性差异 普通读书笔记卡
  2. 有形学院与无形学院 普通读书笔记卡
  3. 共词分析为何要标准化共现矩阵 普通读书笔记卡

04 4.1 多元统计分析理论方法

  1. 因子分析与主成分分析的本质区别 普通读书笔记卡
  2. 聚类分析中矩阵选择的隐藏陷阱 普通读书笔记卡
  3. 战略坐标图的四象限分析法 普通读书笔记卡

05 5.1 社会网络分析理论方法

  1. 社会网络三种中心度指标的含义区分 普通读书笔记卡
  2. 1模网络与2模网络的区别 普通读书笔记卡

06 6.1 NLP理论方法

  1. TF-IDF衡量词条重要性的两个维度 普通读书笔记卡
  2. Word2Vec的CBOW与Skip-gram互为反向 普通读书笔记卡
  3. LDA主题数的选择依据困惑度而非拍脑袋 普通读书笔记卡

06 6.4 分词处理

  1. 中文分词三种模式的适用场景 普通读书笔记卡
  2. 停用词与自定义词典解决分词的两类痛点 普通读书笔记卡

apxB 基本科学指标

  1. 高被引论文、热点论文与高水平论文的区别 普通读书笔记卡

相关主题

暂无公开主题。