9月3日,图检索增强生成(GraphRAG)评测基准GraphRAG-Bench最新排行榜出炉,海致科技自研的AtlasGraphRAG在Novel(文学/小说)与Medical(医疗)两大评测赛道中均拿下第一名,把微软MS-GraphRAG(local)、HippoRAG2等国际主流框架甩在了身后。
这个成绩的分量,得先看GraphRAG-Bench是什么来头。它是学术界首个系统性验证图检索增强生成(GraphRAG)有效性的基准,测试覆盖四大任务类型:事实检索、复杂推理、上下文摘要和创意生成。能在这样一个学术基准上双赛道登顶,意味着AtlasGraphRAG在多个维度的能力都经住了考验。
![]()
为什么GraphRAG突然成了香饽饽?
![]()
传统RAG(检索增强生成)靠向量相似度找资料,遇到需要多跳推理的问题就容易翻车——比如问"A的合伙人在B公司担任什么职位",它可能只找到A,找不到合伙人,更别提把两段信息串起来。GraphRAG的思路是把知识组织成图结构,让模型沿着实体之间的关系去推理,正好补上这块短板。
海致科技这次拿第一,说明国产框架在GraphRAG这个前沿方向上,已经不只是在追赶,而是实打实地跑到了前面。尤其值得注意的是,AtlasGraphRAG在Medical赛道也拿了第一——医疗领域对准确性的要求极高,错误答案可能带来实际风险,能在这个赛道胜出,对框架的可靠性是个有力背书。
登顶之后,挑战才刚开始
![]()
不过,基准测试的领先只是第一步。GraphRAG-Bench验证的是学术能力,真实业务场景里还有一堆问题等着:图构建的成本怎么控制?大规模知识图谱的更新频率怎么保证?推理延迟能不能压到生产环境可接受的范围?这些都不是排行榜能回答的。
对海致科技来说,这次双赛道登顶是个不错的起点,至少证明了技术路线选对了。接下来要看的是,这套框架能不能从论文里的benchmark,走进企业的实际生产环境——那才是真正的考场。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.