「ICAIS2025」探索LLM驱动的知识图谱构建:技术机制、方法对比与未来方向

原文可在 https://t.zsxq.com/karhV 获取
[550页电子书]2025年10月最新出版-知识图谱与大语言模型融合的实战指南:KG&LLM in Action

研究背景
- 研究问题:这篇文章要解决的问题是如何利用大型语言模型(LLMs)来增强知识图谱(KGs)的构建,从而克服传统方法在可扩展性、专家依赖性和管道碎片化方面的挑战。
- 研究难点:该问题的研究难点包括:如何在不依赖预定义模式的情况下从非结构化文本中提取知识,如何动态地整合异构知识源,以及如何在LLMs和知识表示之间建立协同作用。
- 相关工作:该问题的研究相关工作包括传统的知识图谱构建方法、基于规则的提取方法、统计方法和神经网络方法,以及最近利用LLMs进行知识图谱构建的研究。
研究方法
- 本体工程:传统的本体工程依赖于领域专家的手动构建,而LLMs可以通过自然语言处理技术辅助本体建模。论文介绍了两种方法:
- 能力问题(CQ)驱动的本体构建:LLMs解析能力问题或用户故事,识别、分类和形式化领域特定的概念、属性和关系。
- 自然语言驱动的本体构建:直接从非结构化文本中诱导语义模式,消除对明确问题的依赖。
- 结构化生成提取:通过引导推理、模块化提示和交互式细化,内部化潜在的关系结构。
- 开放信息提取(OIE):发现文本中所有可能的实体-关系-对象三元组,优先覆盖和发现而非结构规则性。
- 静态模式驱动的提取:使用预定义的本体结构确保精度和可解释性。
- 动态和自适应的模式驱动提取:将模式视为提取过程中的动态、演化组件。
- 基于模式的提取:依赖于显式的知识模式,强调规范化、结构一致性和语义对齐。
- 无模式的提取:直接从非结构化文本中获取结构化知识,不依赖于任何预定义的本体或关系模式。
- 模式层融合:统一知识图的结构骨干,确保所有知识遵循统一的概念规范。
- 实例层融合:通过实体对齐、消歧、去重和冲突解决,整合具体的知识实例。
- 综合和混合框架:将模式层和实例层融合整合到一个端到端的流程中,超越传统的模块化管道,转向集成的、提示驱动的架构。
结果与分析
- 本体工程:LLMs在能力问题驱动的本体构建中表现出色,能够自动识别和形式化领域特定的概念和关系。自然语言驱动的本体构建也显示出巨大的潜力,能够直接从文本中诱导出高质量的本体结构。
- 知识提取:基于模式的提取方法在初期阶段表现良好,但缺乏灵活性。动态和自适应的模式驱动提取方法显著提高了提取的灵活性和适应性。无模式的提取方法在开放信息提取中表现出色,能够发现文本中的所有可能三元组。
- 知识融合:模式层融合从基于本体的对齐转向数据驱动的对齐,最终实现LLMs启用的规范化。实例层融合通过结构化和推理方法显著提高了对齐的精度。综合和混合框架展示了集成、自适应和生成融合系统的潜力。
总体结论
优点与创新
- 全面的综述:论文系统地回顾了近年来LLM(大型语言模型)在知识图谱(KG)构建中的应用,涵盖了本体工程、知识提取和知识融合三个阶段。
- 多种方法对比:详细分析了基于模式的抽取方法和无模式的抽取方法,展示了不同方法的优缺点。
- 未来研究方向:提出了未来研究的几个关键方向,包括基于KG的推理、动态知识记忆和多模态KG构建。
- 技术机制分析:对代表性框架的技术机制进行了详细分析,揭示了其局限性和优势。
- 系统化的研究框架:论文通过系统化的研究框架,清晰地展示了LLM与知识图谱之间的演变关系,促进了符号化知识工程与神经语义理解之间的融合。
不足与反思
- 可扩展性和可靠性:尽管取得了显著进展,但论文指出当前方法在可扩展性、可靠性和持续适应方面仍存在挑战。
- 提示设计:未来的研究需要进一步改进提示设计,以提高模型的性能和适应性。
- 多模态集成:需要更好地整合多模态数据,以应对模态异质性、对齐噪声、可扩展性和在缺失或不平衡模态下的鲁棒性问题。
- 知识驱动的推理:未来的研究应更加注重知识驱动的推理,以实现更强大和自动化的知识图谱构建,形成一个自我改进的良性循环。
- 静态模式驱动的提取:早期方法使用完全预定义的本体结构来确保精度和可解释性。例如,Kommineni等人在2024年提出的框架使用预定义的本体结构来指导LLM生成Competency Questions (CQs),并在明确的模式监督下进行ABox填充。这种方法虽然确保了高精度,但缺乏灵活性。
- 动态和自适应的模式驱动提取:最近的方法重新构思了模式作为提取过程中的动态、演化组件。例如,AutoSchemaKG在2025年提出通过无监督聚类和关系发现从大规模语料库中诱导模式,并使用多阶段提示来使模式与提取内容一起迭代演化,从而提高开放域的可扩展性。AdaKGC在2023年通过Schema-Enriched Prefix Instruction (SPI) 和 Schema-Constrained Dynamic Decoding (SDD) 机制解决了模式漂移问题,允许模型在不重新训练的情况下纳入新关系和实体类型。
- 模式层融合:模式层融合统一了知识图的结构骨干,确保所有知识遵循统一的概念规范。其发展历程包括:
- 本体驱动的一致性:早期工作依赖于显式的本体作为全局约束,如Kommineni等人在2024年提出的框架通过将提取的三元组与预定义的本体定义对齐来实现高语义一致性,但跨域灵活性有限。
- 数据驱动的统一:为了克服这种刚性问题,LKD-KGC在2025年引入了自适应的、基于嵌入的模式集成,通过向量聚类和LLM驱动的去重自动提取和合并等效的实体类型,使模式对齐能够从数据中动态演变。
- LLM启用的规范化:最近的方法如EDC在2024年通过提示LLM生成模式组件的自然语言定义,并通过向量相似性比较支持自对齐和跨模式映射,从而提高了自动化和语义精度。
- 实例层融合:实例层融合通过实体对齐、消歧、去重和冲突解决,整合具体的知识实例。其发展历程包括:
- 启发式聚类:早期工作如KGGEN在2025年使用迭代LLM引导的聚类来合并等效的实体和关系,通过逐步三元组提取和语义分组揭示语义相关的实体。
- 结构化和推理方法:后来的工作如LLM-Align在2024年将对齐重构为上下文推理任务,使用多步提示增强语义区分,将对齐视为受限制的多种选择问题,而EntGPT在2025年引入了两阶段改进管道,首先生成候选实体,然后应用目标推理进行最终选择,显著提高了对齐精度。
- 结构和检索线索:最近的工作如Pons等人在2025年利用RAG融合来利用类-子类层次结构和实体描述进行零样本消歧,通过图拓扑结合结构和信息检索线索实现更稳健的推理。
- 综合和混合框架:综合和混合框架将模式层和实例层融合整合到一个端到端的流程中,超越传统的模块化管道,转向集成的、提示驱动的架构。例如,KARMA在2025年展示了多代理设计,专门处理模式对齐、冲突解决和质量评估,实现可扩展性和全局一致性。ODKE+在2025年通过本体引导的工作流程将模式监督和实例级验证耦合在一起,提高了语义保真度。Graphusion在2024年引入了一个统一的、提示驱动范式,在单个生成周期内执行所有融合子任务——对齐、巩固和推理。
- 基于知识图谱的推理:未来工作预计将进一步将结构化知识图谱集成到LLMs的推理机制中,增强其逻辑一致性、因果推理和可解释性。高质量、结构良好的知识图谱将为可解释和可验证的模型推理提供基础。现有研究如KG-based Random-Walk Reasoning和KG-RAR展示了这一范式的潜力,但如何增强推理能力以支持更稳健和自动化的知识图谱构建仍然是一个关键挑战。
- 动态知识记忆:实现LLMs驱动的智能体自主性需要克服有限上下文窗口的限制,通过持久、结构化的记忆实现。最近的架构如A-MEM和Zep将知识图谱视为动态内存基底,随着代理互动不断演变,而不是存储静态历史记录。未来的研究将集中在提高可扩展性、时间一致性和多模态集成上,以实现完全自主、知识驱动的智能体。
- 多模态知识图谱构建:多模态知识图谱(MMKG)构建旨在将文本、图像、音频和视频等异构模态整合为统一的结构化表示,从而实现更丰富的推理和跨模态对齐。代表性工作如VaLiK通过预训练的Vision-Language Models(VLMs)将视觉特征转换为文本形式,然后通过跨模态验证模块过滤噪声并组装MMKGs。未来的研究将解决模态异质性、对齐噪声、可扩展性和在缺失或不平衡模态下的鲁棒性等关键挑战。

欢迎加入「知识图谱增强大模型产学研」知识星球,获取最新产学研相关"知识图谱+大模型"相关论文、政府企业落地案例、避坑指南、电子书、文章等,行业重点是医疗护理、医药大健康、工业能源制造领域,也会跟踪AI4S科学研究相关内容,以及Palantir、OpenAI、微软、Writer、Glean、OpenEvidence等相关公司进展。

电子书推荐
[300页电子书]Palantir 股票的大数据,大利润:为什么Palantir是未来企业级AI的潜力股
[555页电子书]从LLM Agent到RAG与知识图谱全攻略实战指南重磅发布——构建具备推理、检索与行动能力的智能体
250页电子书-医学领域的人工智能革命:GPT-4及医学大模型未来展望。OpenAI CEO作序
[100页电子书]知识图谱&大模型双轮驱动的工业 AI 数智化转型权威指南 - Cognite
[73页]OpenAI联合哈佛等重磅发布全球首份ChatGPT使用报告,分析用户增长、使用模式及其经济价值
[140页]Neo4j GraphRAG白皮书
[72页]谷歌推出个性化实时监测主动健康管理大模型PH-LLM
[180页电子书]GraphRAG全面解析及实践-Neo4j:构建准确、可解释、具有上下文意识的生成式人工智能应用
[30页电子书]GraphRAG开发者指南
往期推荐
亚马逊云科技与柯基数据联合打造的“Automotive Services GraphRAG”解决方案亮相慕尼黑IAA展会!
GraphRAG实施中常见挑战的分析及其应对策略-海外图谱增强大模型公司Lettria的GraphRAG实践建议
知识图谱与大模型的融合:SubGraphRAG在减少幻觉和提升准确性上的突破
海外大模型落地故事: Medisolv如何利用GraphRAG破解医疗报告难题 — Writer
图谱增强生成 GraphRAG :突破 GenAI 应用边界的利器
“GraphRAG+DeepSearch” 企业级多模态Agent知识平台V2.0 重磅升级!
利用 Amazon Bedrock 知识库构建 GraphRAG 应用的全面实战指南
理解与创新:RAG、Graph RAG以及Agentic RAG在AI中的应用
引领智能检索新纪元:Graph RAG vs RAG,谁才是真正的AI知识利器?
GraphRAG:连接数据世界的AI新引擎
GraphRAG性能飞跃:结合向量搜索与Agent路由,实现知识图谱复杂问题高效解答
突破AI知识边界:探索GraphRAG、向量RAG和Agentic RAG的融合之路
图谱增强大模型智能新纪元:RAG vs Graph RAG,"生成式+结构化+可解释+深度推理" 驱动的企业智能引擎
颠覆RAG的智能媒体检索利器:GraphRAG详解
用模糊解析强化LangChain的GraphRAG:自动构建知识图谱准确率提升3倍 — 基于BAML的实践笔记
构建高效的GraphRAG系统:简化架构与工具选择的艺术
FrOG:基于知识图谱的开源GraphRAG问答系统研究综述
工业大模型公司 Mivva 解锁能源AI见解:GraphRAG智能问答助手的实践旅程
MMGraphRAG:通过可解释的多模态知识图谱桥接视觉与语言模型
OpenAI重磅发布“KG+LLM”结合的企业智能知识管理红宝书,利用大模型构建时序知识图谱与新一代“GraphRAG”智能体
Timbr GraphRAG:结构化与非结构化数据,驱动更聪明的企业级GenAI
企业GenAI革命:海外大模型创业公司Writer解密GraphRAG和知识图谱如何引领智能知识服务未来
GraphRAG革命:如何利用知识图谱提升LLM的检索与生成能力
GraphRAG:用知识图谱与生成式AI开创关系感知的智能新时代
EraRAG:突破传统GraphRAG限制,实现动态语料库的高效检索增强生成
探索AI未来:GraphRAG——更高效智能的跨文档查询方式
知识增强大模型GraphRAG 如何彻底改变阿尔茨海默病的基因研究和治疗 - 美国Cedars-Sinai 医疗中心
GraphRAG + DeepSearch: 下一代企业级人机协同大模型推理架构及医药法律等领域Agent深度详解
GraphRAG:重新定义信息检索的智能革命
九大GraphRAG的全面评估:GraphRAG-Bench基准测试集解析 - 香港理工&腾讯优图等
什么时候GraphRAG超越传统RAG:突破医学等知识密集任务的AI新范式和GraphRAG-Bench评估框架
Precina Health 如何使用GraphRAG 通过实时洞察彻底改变 2 型糖尿病护理
Graph RAG框架、基本工具和实际用例
基于GraphRAG的妊娠期糖尿病管理本地大模型
OpenTCM:基于GraphRAG的传统中医药知识检索与诊断问答图谱增强大模型系统 - 香港中文大学
HyperGraphRAG:基于超图结构知识表示的新版GraphRAG - 北邮、安贞医院等
多模态GraphRAG初探:文档智能+知识图谱+大模型结合范式
如何构建医疗健康等复杂场景下的Agentic GraphRAG?
Agentic-RAG和GraphRAG双轮驱动,基于NCCN肿瘤医学指南开发用于个性化无幻觉乳腺癌治疗
GraphRAG最新成果:基于图的RAG统一框架深度分析 — 港中深&华为
Diffbot的GraphRAG大模型
医学知识图谱驱动的GraphRAG:Deepseek-R1与Weaviate用于高级Chatbot
利用GraphRAG和数字孪生进行个性化教育:面向工业4.0劳动力发展的虚拟现实、增量式学习和零样本情感分析- 亚利桑那大学等
用GraphRAG和知识图谱解锁GenAI大模型 - Neo4j CTO 演讲视频&PPT
普华永道GraphRAG-工具融合
释放多模态GraphRAG的力量:集成图像特征以获得更深入的洞察 - 2025最新PPT
PIKE-RAG: 微软开源下一代GraphRAG,知识增强大模型解锁企业级私有数据应用落地价值
[2025最新综述解读]定制化大模型的GraphRAG - 香港理工&吉林大学等
(88页)知识图谱增强大模型GraphRAG 2025年最新调研综述 - 密歇根大学、Adobe、Meta、亚马逊等
“大模型+知识图谱”双轮驱动的见解、技术和评估 - 英伟达的GraphRAG
GraphRAG和轻量级LightRAG技术及应用案例深度解析
故障分析怎么做?朴素KG方案及LLM+Graph RAG方案实现思路
GraphRAG 的演变 -Neo4j GenAI Graph Gathering 2.0
微软GraphRAG框架演进之路及带来的一些思考
LazyGraphRAG:微软重磅推出高性价比下一代GraphRAG
提升大型语言模型结果:何时使用GraphRAG
GraphRAG产业化应用落地挑战和探索:知易行难 - 企业大模型独角兽Glean实践之四
微软GraphRAG最新动态:通过动态社区选择改善全球搜索
现有RAG框架非完全总结:7个GraphRAG+17个传统RAG框架归纳
GraphRAG从研发到上线的挑战-硅谷企业级大模型知识库独角兽Glean系列之三
企业级知识库为什么要用GraphRAG - 硅谷企业级ChatGPT独角兽Glean系列之二
企业智能知识库企业Glean利用GraphRAG融资2.6亿美元
MedGraphRAG最新版:探索医学大模型领域的未来新革命 - 牛津&CMU
医学GraphRAG案例研究:将医生记录转换为医学时序知识图谱
微软GraphRAG 0.4.0&DRIFT图推理搜索更新
GraphRAG图检索增强,助力新一代大模型知识库的落地|爱分析活动
StructRAG: 下一代GraphRAG - 中科院&阿里
RAG前沿之RAG–知识图谱构建框架Graphusion:兼看LongRAG双视角检索增强生成范式
Structured-GraphRAG知识增强框架——足球游戏数据案例研究
解锁洞察:金融服务中的GraphRAG和标准RAG对比案例解析
蚂蚁图团队GraphRAG支持社区摘要——Token相比微软直降50%
从知识图谱到 GraphRAG:探索属性图的构建和复杂的数据检索实践
基于图谱和智能体的法律文档 GraphRAG案例深度解析 - WhyHow.AI
什么时候(不)用GraphRAG
GraphRAG工程落地成本详细解读和实例分析
企业生成式人工智能应用的架构模式:GraphRAG、RAG、DSFT和RAFT
知识图谱增强大模型GraphRAG全面综述解读 - 蚂蚁集团、北大、浙大、人大等
GraphRAG:使用知识图谱进行AI Agent编排和工业化路径
贝莱德&英伟达 - HybridRAG:整合GraphRAG和VectorRAG以实现金融信息高效提取
医学GraphRAG:通过知识图谱检索增强实现安全医疗大语言模型 - 牛津大学最新论文
GraphRAG类型、限制、案例、使用场景详细解析
GraphRAG在网络安全情报分析的变革性应用
GraphRAG + GPT-4o mini 低成本构建 AI 图谱知识库
GraphRAG案例讲解-由知识图谱驱动的辅助数据目录元数据发现大模型
GraphRAG有多贵?基于GPT-4o的Token令牌消耗成本分析
使用Streamlit、LangChain、Neo4j和GPT-4o构建GraphRAG实战讲解及开源实现
基于GraphRAG的SEO智能助手实战案例 - 解锁大模型和知识图谱结合的力量
[重磅]图数据库厂商Neo4j CTO详解GraphRAG:为生成式人工智能增添知识
引入GraphRAG的场景条件分析
重磅 - 微软官宣正式在GitHub开源GraphRAG
GraphRAG如何应用于合同文档管理
开源GraphRAG解读:微软的人工智能驱动知识发现方法
揭示微软开源的RAG策略:GraphRAG
Microsoft 的 GraphRAG实践
何时构建知识图谱驱动的GraphRAG系统 — 投入和产出分析
Vector | Graph:蚂蚁首个开源Graph RAG框架设计解读
GraphRAG工作原理揭秘及挑战
从RAG到GraphRAG: 用知识图谱帮助RAG链接数据 — 海外GenAI公司Chanko实践
[万字长文]GraphRAG技术栈及样例全面解析
GraphRAG应用中小图谱与大图谱的角色
GraphRAG:设计模式,挑战和落地指南
从RAG到GraphRAG的应用落地揭秘
快速医疗信息互操作标准FHIR上的GraphRAG
Neo4j与微软合作GraphRAG,以增强GenAI能力
Linkedin的GraphRAG客服问答系统实践
重磅-微软发表GraphRAG论文并即将开源项目
企业级RAG向量检索的限制和Writer的GraphRAG方案 - Part2
海外人工智能公司Writer的GraphRAG实践揭秘- Part1
LLM的前沿高效探索 - GraphRAG: 更好,更快,更便宜
微软的GraphRAG:智能问答系统的革命
从传统RAG到GraphRAG - 当大模型遇见知识图谱
深度解析知识图谱增强的GraphRAG及医药案例
基于知识图谱的RAG全生命周期知识增强 - GraphRAG
GraphRAG: 解锁大模型RAG知识增强
大模型&知识图谱双轮驱动的企业智能与分析用
用智能体优化智能体工具:Anthropic揭秘高效Agent开发新范式
基于知识图谱增强大模型的企业级智能知识库独角兽Glean获1.5亿美元F轮融资,估值72亿美元
DoorDash如何利用知识图谱增强大模型提升搜索召回精度
ESCARGOT:一种利用大模型、动态思维图和生物医学知识图谱以增强推理的AI智能体
论文浅尝 | CogMG:大语言模型与知识图谱的协同增强(ACL2024)
知识图谱增强大模型KERAP:多智能体推理语言模型在零样本诊断预测中的革新应用 - 哈佛大学&埃默里大学等
LLM vs LMM:知识图谱增强大模型驱动营销革新浪潮
BEKO:大语言模型与知识图谱的双向增强-吴信东
重磅发布|智护成长新纪元:知识图谱增强的儿童青少年健康管理智能体
MSG-LLM:多维度互动框架用于图谱增强大模型
[npj 数字医学]知识图谱增强的无幻觉医学信息大模型
DO-RAG:一种使用知识图谱增强检索辅助生成的领域特定问答框架 - 清华大学等
论文浅尝 | KnowGPT:利用知识图谱增强大型语言模型的专业领域问答能力(NeurIPS2024)
知识图谱增强的合规医学大模型产学研新范式探索
RAKG:文档级检索增强知识图谱构建 - 上海人工智能实验室等
AMG-RAG自适应知识图谱增强医学问答:弥合大模型与动态医学知识的差距 - 多伦多大学等
将知识图谱与大模型 (LLM) 协同化:实现语义增强智能的途径
利用大型语言模型增强知识图谱查询-意大利帕维亚大学
喜讯|柯基数据知识图谱增强的医学合规科研智能体荣获信通院智能体应用优秀案例
[论文解读]知识图谱引导的检索增强生成RAG - 南京大学&阿里巴巴
喜讯|柯基数据“知识图谱增强大模型”获得“国家电网科学技术进步奖”三等奖!
富士通推出知识图谱增强RAG软件分析和可视化服务,以支持企业最佳现代化规划流程
知识图谱增强营养健康大模型:迈向改进的管理、可重复性和验证 - RPI等
[2025论文解读]基于知识图谱的思考:一种知识增强的泛癌症问答大模型框架 - 中科院&广州国家实验室等
[VLDB24 KG+LLM论文]利用多模态和知识图谱增强大模型以实现无幻觉的开放集物体识别 - 河海大学等
medIKAL-知识图谱增强大模型以提升电子病历临床诊断能力
KG4Diagnosis - 知识图谱增强的多智能体大模型在医学诊断中的应用
北大Chatlaw - 基于知识图谱增强混合专家模型的多智能体法律助手
Stardog-知识图谱增强大模型企业智能体平台Voicebox的愿景
以内容为中心的粗粒度知识图谱增强大模型的实践研究 - DataStax
EMNLP 2024 | CoTKR:面向复杂知识图谱问答任务的思维链增强的知识改写方法
MedSyn:基于医学知识图谱增强大模型的合成医学文本生成框架
事实发现者 - 通过引入知识图谱增强大模型的生物医药领域专业知识(拜耳制药&IAIS)
KRAGEN:使用知识图谱增强的RAG解决生物医学大型语言模型问题