知识库
让一本书里的知识,彼此连接。
PDF Craft 桌面端使用 Wiki Graph Core 为 PDF 和 EPUB 文本建立索引,搜索结果可以回到原文。若要提取公共实体、关系与摘要,可将整理好的文本交给独立的 wg CLI 继续处理。
从原始材料到知识库
文字预处理与知识索引各有作用。原文和提炼出的知识,都应该能查到。
整理可读文字
先用 PDF Craft 整理 PDF 和 EPUB 中的文字。其他来源可借助外部工具转为纯文本后交给 wg;复杂内容的提取结果仍需对照原件检查。
建立知识索引
在 PDF Craft 桌面端,可为 PDF 或 EPUB 建立 .wikg 文本索引;独立的 wg CLI 还能从整理好的文本中提取公共实体、关系与证据。
探索并核对
在 PDF Craft 中跨文档搜索并跳转原文;用 CLI 探索实体及其关系背后的证据段落。
不止找到某一段文字
同一主题可能散落在一本书的不同章节。把这些线索连起来,也保留它们的出处。
- 找到一个主题
- 搜索原文,或找到文档中提及的实体。
- 顺着关联阅读
- 在独立的 Wiki Graph CLI 中,查看人物、地点、组织和概念如何跨章节产生关联。
- 回到证据
- 打开支撑实体或关系的原文段落,再决定是否采用。
在 PDF Craft 中搜索,用 wg 探索关系
PDF Craft 桌面端
为 PDF 和 EPUB 建立索引,跨文档搜索,并打开匹配内容在原文中的位置。
独立的 Wiki Graph CLI
用 wg 从整理好的文本中生成公共实体、关系、证据与摘要,再沿着关联继续探索。
使用前了解边界
PDF Craft 桌面端目前提供基础全文索引和原文定位;实体关系与摘要需要使用独立的 wg CLI。实体提取以能对齐 Wikipedia 或 Wikidata 的公共概念为主,私人名称可能遗漏。重要结论请回原文核对。SDPUB 的章节阅读图谱是另一种阅读体验。
了解 SDPUB 阅读