Co-Evolving Graph and Text Memory for Training-Free Multi-Hop Question Answering

TL;DR

提出Co-E系统,利用同步双向图文本记忆实现无训练多跳问答,显著优于基线。

cs.CL 🔴 高级 2026-07-26 44 次浏览
Hieu Man Thien Huu Nguyen
多跳问答 图文本同步 无训练 知识图谱 记忆增强

核心发现

方法论

本文提出的Co-E系统基于同步双向的图-文本工作记忆,结合四步同步循环(整合文本、提取关系三元组、注入图、再整合文本)实现无训练的多跳问答。系统在每一步中,从文本和知识库流中检索证据,过滤后通过实体链接和关系抽取扩展图记忆,并将图事实转化为自然语言注入文本记忆中,形成闭环。采用MCTS和链式推理两种策略,利用共享记忆引导推理路径,避免预定义图结构限制。核心机制是双向同步操作,确保文本和图记忆相互修正,提升推理准确性。

关键结果

  • 在六个多跳问答基准上,Co-E(MCTS)在2WikiMultiHopQA达72.6%的EM,在Bamboogle达70.0%,在CWQ达74.9%的Hits@1,均优于无训练基线,且与训练模型竞争。特别是在需要长链推理和桥实体维护的任务中表现优越,超越多种基于图和文本的对比方法。
  • 在KGQA场景中,WebQSP达85.5%的Hits@1,CWQ达74.9%,优于大部分开源模型。无训练的同步记忆机制显著提升多跳推理的效果,验证了其在复杂推理中的优势。
  • 消融实验显示,双向同步、图文本记忆的结合和主动维护机制是性能提升的关键,单向传递或缺少记忆维护会导致性能大幅下降。

研究意义

该研究突破了多跳问答中图与文本信息的孤立处理瓶颈,实现无需训练的动态记忆同步,有助于提升知识推理的灵活性和准确性。其创新机制为未来大规模知识推理系统提供了新思路,推动无训练模型在复杂推理任务中的应用落地,具有重要的学术价值和实际意义。

技术贡献

提出同步双向图文本记忆机制,结合四步同步循环,突破传统单向检索和静态图结构限制。系统无需微调,兼容多种推理策略,显著提升多跳问答性能。引入实体链接、关系抽取和图事实转化自然语言的集成方案,为知识推理提供了新型的动态记忆框架。

新颖性

首次实现无训练、多跳问答中图文本记忆的同步共演机制,结合四阶段同步循环,动态扩展和修正推理状态。区别于以往依赖预建图或单向检索的方案,强调记忆的双向修正和主动维护,显著提升推理的连贯性和准确性。

局限性

  • 系统依赖高质量的实体链接和关系抽取,若抽取错误会影响整体推理效果,特别是在噪声较多的文本环境中。
  • 在极长链或复杂关系场景下,记忆同步可能导致信息冗余或遗漏,影响推理效率和准确率。
  • 当前未充分考虑多模态信息融合,未来可结合视觉或声音等多模态数据以增强推理能力。

未来方向

未来将探索多模态信息融合,提升实体和关系抽取的鲁棒性,优化同步机制以应对更复杂的推理场景。同时,结合少样学习和微调策略,增强系统的适应性和泛化能力,推动其在实际应用中的落地。

AI 总览摘要

多跳问答作为人工智能中的核心挑战之一,要求模型在多轮推理中不断整合关系和文本证据,传统方法多依赖预定义图结构或大量训练,存在灵活性不足的问题。本文提出的Co-E系统创新性地实现了无训练、多跳推理中的图-文本同步共演机制,突破了现有模型的局限。

该系统通过四阶段同步循环(整合文本、关系抽取、注入图、再整合文本)实现动态记忆更新,确保在推理过程中图和文本信息相互修正、共同演进。采用共享记忆结构,支持多种推理策略(MCTS和链式推理),在六个公开基准上表现优异,显著优于无训练的对比模型,尤其在需要长链推理和桥实体维护的任务中优势明显。

实验结果显示,系统在多跳文本问答和知识图谱问答中均取得了突破性进展,验证了同步记忆机制的有效性。该方法不仅提升了推理的准确性,也为未来无训练知识推理系统提供了新思路,具有重要的学术价值和广泛的应用潜力。

然而,系统仍依赖高质量的实体链接和关系抽取,面对复杂场景时可能存在信息冗余或遗漏问题。未来工作将聚焦多模态融合、鲁棒性增强和泛化能力提升,推动其在实际场景中的应用落地。

深度分析

研究背景

多跳问答作为知识推理的关键任务,近年来随着大型预训练模型的发展逐渐成为研究热点。早期方法多依赖预定义的知识图谱(如Freebase、Wikidata)进行结构化推理,代表算法包括路径搜索和图神经网络(GNN)等。近年来,检索增强生成(RAG)模型通过结合文本检索提升知识覆盖,但受限于单向检索和静态图结构,难以应对复杂推理链。多跳问答的核心难点在于证据的动态整合和推理状态的持续更新,传统方法多采用逐步检索或预先构建的子图,缺乏灵活性和实时性。近年来,Memory-augmented和Graph-augmented方法试图解决这一问题,但多为单向或静态维护,未实现图与文本的双向动态同步。本文在此基础上提出同步双向记忆机制,旨在实现推理状态的持续修正和知识的动态扩展,推动多跳问答向更高效、更灵活的方向发展。

核心问题

多跳问答的核心难题在于如何在推理过程中动态整合关系图和文本证据,避免信息孤岛和静态限制。传统模型多依赖预定义图或单向检索,导致推理链断裂或信息遗漏,难以应对复杂、多层次的推理需求。尤其在涉及长链关系或桥实体时,单一记忆结构难以保持信息一致性和连续性。现有方法在推理过程中缺乏有效的反馈机制,无法实现图和文本的双向修正,限制了模型的推理深度和准确率。因此,设计一种能够实时同步、动态修正推理状态的机制成为亟待解决的问题。

核心创新

本文的创新点主要在于提出同步双向的图-文本工作记忆机制,结合四阶段同步循环,实现无训练、多跳推理中的动态记忆更新。具体包括:• 通过整合文本证据,提取关系三元组,注入图记忆,形成闭环;• 利用实体链接和关系抽取,将文本信息转化为结构化图,扩展推理边界;• 将图事实转化为自然语言,注入文本记忆中,增强生成的语境信息;• 引入多策略推理(MCTS和链式推理),利用共享记忆引导路径选择,避免预定义图结构限制。这些创新共同实现了推理状态的持续修正和知识的动态扩展,显著提升多跳问答的效果。

方法详解

  • �� 输入问题和上下文,生成子查询;• 从文本和知识库中检索证据流(文本片段和关系三元组);• 通过实体链接和关系抽取,将文本证据转化为关系三元组,合并到图记忆中,扩展推理边界;• 将存留的图三元组自然语言化,注入文本记忆,增强上下文;• 在每个推理步骤中,利用同步操作(整合文本、关系提取、注入图、再整合文本)实现双向记忆修正;• 支持多策略推理(MCTS和链式推理),利用共享记忆引导路径选择和结果优化;• 最终输出答案,并更新记忆状态,形成闭环推理。

实验设计

采用六个公开基准(包括WebQSP、CWQ、2WikiMultiHopQA、HotpotQA、MuSiQue、Bamboogle),评估模型的多跳问答性能。对比训练模型和无训练基线,采用EM和Hits@1指标。通过消融实验验证双向同步、记忆机制和检索策略的重要性。参数设置包括Qwen3-8B作为推理基础模型,关系抽取和检索采用特定算法,确保公平比较。实验还分析不同同步策略和记忆维护对性能的影响,验证系统在复杂推理场景中的优势。

结果分析

在六个基准上,Co-E(MCTS)在2WikiMultiHopQA达72.6%的EM,在Bamboogle达70.0%,在CWQ达74.9%的Hits@1,均优于无训练基线。特别是在桥实体和长链关系任务中表现优越,超越多种基于图和文本的对比方法。消融实验显示,双向同步和主动记忆维护是性能提升的关键,单向或缺少维护会导致性能显著下降。结果验证了同步机制在复杂推理中的有效性,为无训练问答提供新思路。

应用场景

该系统适用于需要高精度、多跳推理的知识问答场景,如智能助手、自动问答系统、知识库维护等。无需大量训练数据,适合资源有限环境,能动态扩展知识边界,提升问答的准确性和灵活性。未来可结合多模态信息,实现跨模态推理,推动行业智能化升级。

局限与展望

系统依赖高质量的实体链接和关系抽取,抽取错误会影响整体效果。面对极长链或复杂关系时,记忆同步可能导致信息冗余或遗漏。当前未充分融合多模态信息,未来需增强鲁棒性和泛化能力。此外,推理过程计算成本较高,需优化算法以适应大规模应用。

通俗解读 非专业人士也能看懂

想象你在厨房里做饭。每次你拿到食材(文本信息)时,会根据食谱(知识图)来判断怎么搭配。以前,厨师只会用一份食谱,按照固定步骤做菜,但如果遇到新食材或特殊口味,就会出错。现在,厨师用一种聪明的方法:每次尝试后,都能根据实际情况调整食谱(图)和用料(文本),两者互相学习和修正。这样,不管遇到什么新菜,都能灵活应对,做出美味佳肴。这个系统就像厨师一样,能不断调整食谱和材料,确保每次都做出最合适的菜肴,完全不用提前准备好所有的菜谱。

简单解释 像给14岁少年讲一样

想象你在玩一个超级复杂的拼图游戏。每次你拼完一块,就会根据拼图的样子,决定下一块应该放在哪里。有时候,你发现一块拼图可以帮你找到隐藏的线索,但你也需要记住之前拼的部分,才能继续拼下去。这个系统就像你一样,不仅记住每一块拼图,还会根据拼图的样子,调整下一步的策略。它可以不断修正自己,确保每次拼图都越来越接近完整。这样,无论拼多复杂的图片,它都能一步步搞定,甚至不用提前知道全部拼图的样子。

术语表

同步双向记忆 (Bidirectional Memory Synchronization)

一种同时更新图和文本记忆的机制,确保两者在推理过程中相互修正。技术上通过四阶段循环实现,包括整合、抽取、注入和再整合。

论文中的核心机制,用于动态修正推理状态。

多跳问答 (Multi-Hop Question Answering)

一种需要多轮推理、逐步整合证据以得出答案的任务。涉及长链关系和桥实体,难度较高。

系统设计和性能评估的主要任务类型。

关系三元组 (Relational Triples)

由实体和关系组成的结构化信息,用于表示知识图中的关系。抽取自文本或知识库,支持推理扩展。

构建图记忆的基础单元。

共享记忆 (Shared Memory)

在推理过程中同时维护文本和图的记忆结构,支持双向信息流动和动态修正。

系统实现的核心技术。

MCTS (蒙特卡洛树搜索)

一种探索多路径推理的搜索策略,通过模拟和评估选择最优路径。适用于复杂推理树的路径选择。

多策略推理中的路径搜索方法。

开放问题 这项研究留下的未解疑问

  • 1 如何进一步提升同步机制在极长链推理中的效率和准确性,尤其在多模态信息融合场景下的应用尚未充分探索。

应用场景

近期应用

智能问答系统

可用于企业客服、智能助手等场景,提升多轮复杂问答的准确性和效率,无需大量训练数据,适应多变知识环境。

知识库维护

自动扩展和修正知识图,支持动态知识更新和推理,降低人工维护成本。

远期愿景

通用智能推理平台

结合多模态信息,实现跨领域、跨模态的动态推理,推动AI在科学研究、医疗诊断等领域的深度应用。

原文摘要

Multi-hop question answering requires coordinating relational and textual evidence across reasoning steps, a combination neither a text corpus nor a knowledge graph can supply alone. Prior work often emphasizes only part of this loop: graph-augmented RAG retrieves from a pre-built or query-updated graph, KGQA systems search within topic-centered subgraphs, and memory-augmented agents maintain evolving memories without continuously reconciling graph memory with textual context. We propose Co-E, a training-free system built around synchronized bidirectional graph-text working memory. A synchronization cycle consolidates textual memory, extracts relational triples into graph memory, and injects graph facts back into the generation context. Because both memories are maintained, they shape subsequent retrieval and generation. Evaluated on six multi-hop QA benchmarks, Co-E improves over comparable training-free open-backbone baselines and is competitive with larger or trained systems.

cs.CL cs.MA