网易首页 > 网易号 > 正文 申请入驻

刷新全球权威基准测试纪录!这家国产厂商在AI存储布局有多深?

0
分享至

智东西
作者 杨京丽
编辑 李水青

一、三节点带宽刷新纪录,保证高效读写效率二、AI进入推理阶段,存储开始管理模型上下文三、补上共享缓存层,KV Cache实现跨节点复用四、从训练到推理,AI存储还要算效率和成本账结语:从高吞吐到高复用,AI存储进入全流程竞争



智东西9月17日报道,9月1日,全球权威AI性能评测组织MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项基准测试中拿下第一,充分验证其在极限AI训练负载下对高速网络带宽的高效利用能力



▲数据引用:MLPerf Storage Benchmark v3.0 Suite Results 2026

随着AI产业从模型训练走向规模化推理,存储系统需要处理的数据和承担的任务也在增加。训练阶段,存储要持续向GPU供给海量数据,还要快速保存和恢复模型 Checkpoint;推理阶段,系统又要管理不断膨胀的KV Cache。单一的高性能存储产品已经难以覆盖AI全流程需求。

围绕AI的训练与推理场景,焱融已经构建起一套较为完整的全栈AI存储方案。F9000X的测试成绩充分验证其训练侧能力:本次MLPerf Storage v3.0新增KVCache测试用例,进一步扩展了其对AI全场景工作负载的覆盖能力。

焱融科技近期推出的YRCache ContextBox一体机,就是面向AI推理场景的专属KV Cache存储产品,也是其全栈AI存储能力在KV Cache管理、共享与复用方向的进一步落地。

从训练数据的高速读写,到推理上下文的共享与复用,焱融是如何应对AI不同阶段的存储需求?这套全栈AI存储方案又能为企业带来怎样的性能和成本价值?本文对此进行了深入解读。

大模型训练需要持续从存储系统读取数据。随着参与训练的GPU数量增加,存储系统需要同时为更多计算节点供给数据。如果数据吞吐能力不足,GPU可能因等待数据而降低利用率。训练过程中还需要定期写入Checkpoint,其读写性能会直接影响模型状态的保存和训练中断后的恢复耗时。

焱融F9000X是面向大规模AI训练推出的全闪存储产品,其训练侧实力可以从MLPerf Storage基准测试中得到验证。测试环境包括3台F9000X存储节点和9台x86客户端服务器,节点通过NDR400高速网络互联。



3D U-Net模型训练测试对存储系统的持续带宽输出能力和极限负载稳定性,提出了较高要求。测试中,F9000X三节点集群实现544GiB/s聚合带宽,位列该场景第一,达到了历届公开测试成绩中的最高水平。相比此前v2.0测试的478GiB/s,其聚合带宽进一步提升,表明存储系统能够更高效地向GPU提供训练数据。

在Checkpoint 70B测试中,焱融存储集群实现539GiB/s的读带宽和314GiB/s的写带宽,读写性能均位居第一,刷新历届MLPerf Storage公开测试成绩。对于千亿级、万亿级模型训练,Checkpoint是保存阶段性训练状态的关键数据。更快的读写速度,可以缩短模型存档和恢复耗时,降低训练中断造成的算力浪费。



▲数据引用:MLPerf Storage Benchmark v3.0 Suite Results 2026

对企业而言,焱融F9000X更高的带宽表现不仅能够加快训练数据读写,也有望在满足同等训练需求的情况下减少存储节点投入,从而降低整体硬件投入成本。

随着AI进入推理阶段,存储系统关注的重点转向模型上下文的管理与复用。长文本、多轮对话和Agent应用会产生大量KV Cache,如果这些缓存无法被保存和复用,模型就需要反复计算相同的上下文。与此同时,推理请求的上下文更长、并发更高,KV Cache需要在不同节点之间共享、迁移和复用。

针对这一问题,焱融推出AI原生推理存储系统YRCache,对不同层级的KV Cache资源进行统一管理,并将部分缓存从GPU显存卸载至主机内存和本地SSD,减少重复计算。

在YRCache的多级缓存架构中,G1是GPU HBM,负责保存当前最活跃、访问频率最高的KV Cache;G2是主机DRAM,用于承接暂时无法放入GPU显存的缓存;G3是本地SSD,容量更大、单位成本更低,适合保存单节点中的更多缓存;G4则是传统共享分布式存储,主要承载模型、数据集和Checkpoint等需要长期保存的数据。



随着推理集群扩大,本地SSD与传统共享存储之间出现了新的能力空档。参考英伟达CMX架构对G3.5 Context Memory的设计,焱融在YRCache体系中引入了G3.5共享缓存层,并推出YRCache ContextBox一体机,面向长上下文、多轮对话和Agent推理提供跨节点共享的KV Cache空间,在靠近计算的同时支持缓存共享、复用和独立扩展。



YRCache ContextBox面向G3.5共享缓存层设计,将计算、网络、存储和软件协同起来,为推理集群提供独立的共享KV Cache空间。焱融科技称,ContextBox单台实测带宽达120GB/s,可支持8个推理节点并发接入,缓存容量可扩展至PB级。



YRCache ContextBox首先让不同推理节点能够共享已经生成的KV Cache。请求即使被调度到另一台服务器,也不必重新计算相同的上下文。与此同时,缓存不再受单台服务器的显存、内存和SSD容量限制,企业可以单独扩展缓存空间;即使计算节点增减,已经保存的缓存也不会随之丢失。

据焱融科技介绍,在某头部AI企业测试中,8张NVIDIA H20-3e GPU运行SGLang和GLM-5.1,输入上下文为31K至129K时,接入ContextBox后首Token时延降低89%至94%,Token吞吐提升3至6倍

ContextBox还兼容YRCache、LMCache、Mooncake等管理软件,为长上下文、多轮对话和Agent推理提供共享、可扩展的上下文基础设施。



作为国内较早、较完整面向AI全流程构建全栈AI存储能力的厂商之一,焱融已形成覆盖AI训练与推理的存储方案,以F9000X、YRCache推理存储系统和YRCache ContextBox一体机为代表,覆盖训练数据读取、模型状态保存以及KV Cache管理等关键环节。

这套布局对应了AI应用的不同阶段:训练时,F9000X提升数据和Checkpoint的读写效率,减少GPU等待;推理时,YRCache和YR Cache ContextBox管理、共享并复用KV Cache,减少重复计算。

对企业而言,这套方案的价值不只是提升带宽或降低时延,更在于让现有算力基础设施承载更多训练任务和推理请求。存储效率提高后,企业不必只依靠增加GPU或存储节点来扩大AI服务能力。

性能之外,成本也是AI基础设施建设的重要考量。焱融科技称,其单位性能硬件成本较行业市场平均水平降低约35%,同时Token效能提升120%。在提升AI存储效率的同时,能够更好地控制基础设施投入。

从训练数据供给,到模型状态保存,再到推理上下文复用,焱融试图用一套覆盖全流程的存储方案,减少算力等待和资源浪费,让企业已经投入的GPU、网络和存储设备发挥更大价值。

当AI竞争进入规模化应用阶段,存储不再只是后台的数据底座,而成为影响GPU利用率、推理效率和建设成本的关键基础设施;焱融通过覆盖训练与推理场景的全栈AI存储方案,帮助企业把算力和基础设施投入用得更充分。

随着模型规模、上下文长度和并发请求继续增加,AI存储的竞争也将从单一的峰值性能,转向对不同数据、不同层级和不同使用周期的协同管理。AI基础设施的建设越来越需要以更可控的成本承载更多训练任务和推理请求。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
浙江一“猪景房”8888元一晚,牧场回应:送一头价值6888元的两头乌猪;房间紧挨着两头乌猪圈,只隔了层玻璃

浙江一“猪景房”8888元一晚,牧场回应:送一头价值6888元的两头乌猪;房间紧挨着两头乌猪圈,只隔了层玻璃

大风新闻
2026-09-17 17:21:04
李小璐疑似新男友曝光!被拍到与嘻哈歌手赵涛逛公园,4年3次同框引猜测

李小璐疑似新男友曝光!被拍到与嘻哈歌手赵涛逛公园,4年3次同框引猜测

露珠聊影视
2026-09-17 16:25:38
9月17日新消息!大家苦等的2026退休养老金到底涨不涨,怎么涨?

9月17日新消息!大家苦等的2026退休养老金到底涨不涨,怎么涨?

兵卒史
2026-09-17 15:19:10
快讯!印尼认栽了!

快讯!印尼认栽了!

故事终将光明磊落
2026-09-17 13:49:41
1999 年公安部下达秘密指令抓捕赖昌星,福建省公安厅一位副厅长深夜接连拨打四通电话,他在通话中的一句话,令专案组成员全部大为震惊

1999 年公安部下达秘密指令抓捕赖昌星,福建省公安厅一位副厅长深夜接连拨打四通电话,他在通话中的一句话,令专案组成员全部大为震惊

温柔记事簿
2026-09-17 10:41:47
有后续了!快递员救助摔倒老人反被索赔92万,驳回老人上诉请求

有后续了!快递员救助摔倒老人反被索赔92万,驳回老人上诉请求

西昆仑Bruce
2026-09-17 16:15:19
奥迪新车官宣:9月20日,正式上市

奥迪新车官宣:9月20日,正式上市

科技堡垒
2026-09-17 11:09:13
女网红和健身男子发生性关系,用力过猛导致女生腰部骨折,网友询问:什么招式,这么生猛?

女网红和健身男子发生性关系,用力过猛导致女生腰部骨折,网友询问:什么招式,这么生猛?

黯泉
2026-09-17 15:54:41
rapper赵涛恋情曝光!带甜馨妈妈和小女孩散步,4年前约会曾被拍

rapper赵涛恋情曝光!带甜馨妈妈和小女孩散步,4年前约会曾被拍

杨仔述
2026-09-17 14:56:22
合着查了半天,跟文物没一毛钱关系 :原南博院长徐湖平以“受贿罪”被判三年有期徒刑

合着查了半天,跟文物没一毛钱关系 :原南博院长徐湖平以“受贿罪”被判三年有期徒刑

云中有一鹤
2026-09-17 00:20:04
苹果新品官宣,9月18日,正式发售

苹果新品官宣,9月18日,正式发售

科技堡垒
2026-09-17 11:07:17
离谱!中国女子板球队1场未打告别亚运 场地积水致比赛取消+被判负

离谱!中国女子板球队1场未打告别亚运 场地积水致比赛取消+被判负

我爱英超
2026-09-17 12:29:33
四年流向华为体系 1113 亿、自身扣非仅赚 14.8 亿:赛力斯这笔账到底亏不亏

四年流向华为体系 1113 亿、自身扣非仅赚 14.8 亿:赛力斯这笔账到底亏不亏

新浪财经
2026-09-17 09:17:03
美国中将公开承认:打完伊朗,我才看清中国到底有多强大!

美国中将公开承认:打完伊朗,我才看清中国到底有多强大!

果妈聊娱乐
2026-09-17 08:20:56
太现实了!17999元买台手机,上海打工67天,西宁却要174天

太现实了!17999元买台手机,上海打工67天,西宁却要174天

可达鸭面面观
2026-09-17 17:06:02
已击毙!乌克兰宣布重大战果!

已击毙!乌克兰宣布重大战果!

故事终将光明磊落
2026-09-17 08:13:53
实锤了!隔壁班同学证实杨景媛确实在西班牙读博了,网友:让她无处可逃

实锤了!隔壁班同学证实杨景媛确实在西班牙读博了,网友:让她无处可逃

小徐讲八卦
2026-09-17 14:59:38
美国与胡塞武装达成协议:胡塞不打美国,以色列船只,只打沙特

美国与胡塞武装达成协议:胡塞不打美国,以色列船只,只打沙特

以色列飛飛
2026-09-17 15:30:03
敬一丹告别仪式:董卿罕现身,王宁表情沉痛,挽联写尽一生风骨

敬一丹告别仪式:董卿罕现身,王宁表情沉痛,挽联写尽一生风骨

林轻吟
2026-09-17 16:19:15
扶不扶?老人摔倒京东快递小哥施救后,反被家属索赔92万,法院还他清白

扶不扶?老人摔倒京东快递小哥施救后,反被家属索赔92万,法院还他清白

汉史趣闻
2026-09-17 09:07:10
2026-09-17 20:32:50
智东西 incentive-icons
智东西
智东西,AI产业新媒体,专注报道人工智能的前沿技术发展,和技术应用带来的千行百业产业变革。
12610文章数 117168关注度
往期回顾 全部

科技要闻

影视飓风Tim反掰iPhoneDuo被质疑

头条要闻

小伙拍母亲最后14天看哭网友:从"铿锵有力"到天人永隔

头条要闻

小伙拍母亲最后14天看哭网友:从"铿锵有力"到天人永隔

体育要闻

逆转朝鲜,国足亚运队“啃老”过关

娱乐要闻

rapper赵涛恋情曝光!带甜馨妈妈散步

财经要闻

缺钱的追觅 隐藏的债务?

汽车要闻

猛士X700内饰正式公开 华为技术加持打造家庭泛越野智能座舱

态度原创

亲子
时尚
本地
房产
公开课

亲子要闻

宝蓝盲猜糖果还是冰淇淋大挑战,快看看谁赢了~

初秋衣服不用买得太多,准备几件针织衫,温柔大方又显气质

本地新闻

不止胖东来!许昌藏着半部三国史

房产要闻

突发!三亚安居房出台新政!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版