首页>动态宝
在专业性、事实敏感度更高的医疗领域,AtlasGraphRAG 的优势进一步扩大,各项指标 ACC 均领先第二名:事实检索(ACC 73.73)、复杂推理(ACC 76.35)、上下文摘要(ACC 78.90)、创意生成(ACC 73.48)。
医疗、金融等对事实准确性“错不起”的行业,恰恰是传统 RAG 技术的“深水区”,也是 GraphRAG 展现核心价值的必争之地。为什么有了传统 RAG,还需要 GraphRAG?传统 RAG 擅长“找相似文本”,但在面对跨文档关联、多跳逻辑推理以及全局性总结时,往往会因为文本分块导致上下文割裂,难以给出精准答案。而 GraphRAG 通过构建知识图谱,将碎片化信息织成一张“关系网”,能够像人类专家一样进行多跳推理和全局洞察。数据验证了 GraphRAG 的不可替代性,据 GraphRAG 官方知识库技术评测资料:在需要连接多个事实的复杂查询中,GraphRAG 的召回率可稳定在 94% 以上,而传统向量 RAG 往往不足 60%;在复杂推理型任务中,其准确率更是提升了约 27.8个百分点。AtlasGraphRAG 在两大赛道以显著优势夺冠,正是用可复现、可验证的公开评测数据证明了:在医疗诊断、金融风控等需要深度逻辑推理与高可信度的严肃场景中,GraphRAG 不仅是传统 RAG 的有力补充,更是大模型在真实世界复杂任务、垂直行业真正落地的关键技术支撑。这一成绩的背后,是海致科技扎实的“图底座”能力。此次登顶所依托的 AtlasGraphRAG,基于公司自研的AtlasGraph 图数据库构建——该引擎曾在权威基准测试 LDBC 中以高出原纪录 45% 的成绩打破世界纪录。在业界公认的复杂推理抗幻觉评测 MuSiQue 中,海致独创的“图模融合”技术得分超过 50%,同期传统大模型不足 10%、向量 RAG 方案不足 40%。“知识图谱的确定性结构”与“大模型的泛化生成”深度融合,正是 AtlasGraphRAG 在 Novel 与 Medical 双赛道登顶的技术密钥。 注:榜单中的 ACC 指事实准确率。 了解更多榜单信息:.io/
打破纪录!海致 AtlasGraphRAG 同时登顶 GraphRAG-Bench 两大赛道
发布时间:2026-09-04 10:38 9 月 3 日,图检索增强生成(GraphRAG)权威评测基准 GraphRAG-Bench 最新排行榜显示,海致科技自主研发的 AtlasGraphRAG 在该基准的 Novel(文学/小说) 与 Medical(医疗) 两大评测赛道中,双双斩获第一名。这一成绩不仅超越了微软 MS-GraphRAG(local)、HippoRAG2 等国际主流框架,更标志着中国企业在 GraphRAG 这一前沿 AI 技术领域已达到全球领先水平。GraphRAG-Bench 是学术界首个系统性验证图检索增强生成(GraphRAG)有效性的权威基准。该基准涵盖事实检索、复杂推理、上下文摘要和创意生成四大任务类型,难度逐级递增,能够全面检验模型在图构建、知识检索到最终生成全流程中的综合能力。在最新 Novel 榜单中,AtlasGraphRAG 以 66.18 分的平均综合成绩高居榜首,在事实检索(ACC 66.37)、复杂推理(ACC 61.80)、上下文摘要(ACC 71.47)和创意生成(ACC 65.09)等多项细分指标上均表现优异。这一成绩大幅领先于排名第二的 AutoPrunedRetriever-llm(63.72分)和排名第三的 G-Reasoner(58.94分)。GraphRAG-Bench (Novel) 榜单(节选前五)
GraphRAG-Bench (Medical) 榜单(节选前五)
-END-
(海致科技集团 动态宝)
来源︱动态宝
评论 (0)