让两千年的文字活过来:深度拆解《史记》知识库 —— 从 57 万字古籍到 Agentic Ontology 知识图谱新范式(附 103 个 SKILL 与智能体演化实践)
2026-08-06
14 min read
# zhi-shi-tu-pu
# shu-zi-ren-wen
# kai-yuan-xiang-mu
# ai-agent
# jing-yan-fen-xiang
两千年来,历代学者读《史记》,靠的是案头批注、朱砂圈点与皓首穷经的线索考据;然而面对五十七万字、跨越三千年的皇皇巨著,人脑在处理上万名历史人物、数千场战争会盟与盘根错节的世系传承时,天然存在着记忆碎片化与线性阅读的认知天花板。
近期,由知名知识工程学者鲍捷博士(W3C OWL 2 工作组成员、原文因互联 CEO)主导的开源数字人文里程碑项目 baojie/shiji-kb(史记知识库)引发了学术界与开源社区的巨大轰动:它通过 LLM Agent 与可复用的领域技能(Skills),将《史记》全本 130 篇、57.7 万字完整转化为包含 14,065 个实体、126,441 次标注、3,198 个历史事件与 20,830+ 维基页面的高精度交互式知识图谱。
更具范式革命意义的是,该项目提出了颠覆传统知识工程的 Agentic Ontology(智能体本体论) 新范式,并通过完全由自主 AI Agent(Butler)自驱进化的“三层反思机制”,彻底打破了从 2001 年语义网诞生以来本体构建高成本、不可扩展的“专家手工地狱”。