文件清理
比對原始 PDF、OCR/Markdown 轉換檔與實際頁碼定位,檢驗表格、公式或文字層是否存在失真或缺漏。
將檢索結果轉化為可閱讀、可精準定位、可比較且能相互串聯的研究資產。請注意:清理後的 Markdown 僅為閱讀輔助,並非原始證據。
比對原始 PDF、OCR/Markdown 轉換檔與實際頁碼定位,檢驗表格、公式或文字層是否存在失真或缺漏。
使用統一欄位結構,客觀比較各篇文獻的研究問題、理論視角、研究方法、主要主張、研究限制及其對本研究的具體作用。
清楚標記核心節點、關聯類型、來源 ID 與研究者推論,進而建構具備可維護性的知識庫起始版本。
請採用PDF 清理工作流程,原始 PDF 需維持完整原貌;關鍵引文一律回溯原始檔案或出版單位版本確認。
請採用文獻樹工作流程,確保每個核心節點皆可精準對應至特定來源 ID。
無論選用 Obsidian/Wiki、純 Markdown 檔案或 RAG 架構皆可;首要之務是先將文件的詮釋資料(Metadata)與版本資訊建立完整。