ナレッジベース
一冊の本にある知識をつなぐ。
PDF Craft デスクトップは Wiki Graph Core で PDF と EPUB のテキストを索引化し、検索結果から原文へ戻れます。公開エンティティ、関係、要約を抽出するには、整えたテキストを独立した wg CLI でさらに処理します。
元の資料からナレッジベースへ
テキストの前処理と知識の索引化には、それぞれ役割があります。原文も整理した知識も参照できます。
読めるテキストにする
PDF と EPUB のテキストは PDF Craft で整えます。ほかの資料は外部ツールでプレーンテキストに変換してから wg で利用できます。複雑な抽出結果は原文で確認してください。
索引を作る
PDF Craft デスクトップでは PDF や EPUB の .wikg テキスト索引を作れます。独立した wg CLI は、整えたテキストから公開エンティティ、関係、根拠も抽出できます。
探索して確かめる
PDF Craft では索引済みの文書を横断検索して原文へ戻れます。CLI ではエンティティと関係を支える文章を探索します。
一致する段落を探すだけではない
同じ話題が本の複数の章に現れることがあります。出典を残したまま手がかりをまとめます。
- 話題を見つける
- 原文を検索するか、文書に登場するエンティティを見つけます。
- 関連をたどる
- 独立した Wiki Graph CLI では、人物、場所、組織、概念が章をまたいでどうつながるかを確認できます。
- 根拠を確認する
- エンティティや関係を支える原文を開き、利用する前に確かめます。
PDF Craft で検索し、wg で関係を探索。
PDF Craft デスクトップ
PDF と EPUB を索引化し、文書を横断検索して、該当する原文の位置を開きます。
独立した Wiki Graph CLI
整えたテキストから wg で公開エンティティ、関係、根拠、要約を生成し、つながりを探索します。
利用前に知っておきたいこと
PDF Craft デスクトップは現在、基本的な全文索引と原文への移動を提供します。エンティティの関係や要約には独立した wg CLI が必要です。抽出対象は Wikipedia や Wikidata と対応づけられる公開概念が中心で、非公開の名称は見落とす場合があります。重要な内容は原文で確認してください。SDPUB の読書グラフは別の読書体験です。
SDPUB の読書機能を見る