三年三连冠焱融全闪再创AI存储基准测试MLPerfStorage世界纪录
2026-09-02 12:01:16  今日头条   [查看原文]

三年三连冠 焱融全闪再创AI存储基准测试MLPerf Storage世界纪录

OCR:IMG:焱融 |中国先进AI存力厂商 焱融全闪AI存储 F9000X 再创国际权威MLPerfStorage基准测试 Commons 世界纪录 544GiB/S再刷AI存力新记录 3节点集群突破 MPe由图灵笑得主DavidPatteon联合顶突学术 机构发起,是全球最权威、具影物力的A基准洲试

OCR:IMG:多节点x86AI计算集群 NVIDIAQM9700400GbpsInfiniBand交换机 3节点焱融全闪F9000X存储集群 YRCloudFilePOSIXClient 焱融全闪存储一体机F9000X 2xInfiniBandNDR400links 4xInfiniBandNDR400links

OCR:IMG:存储集群性能(3DU-Net) 544GiB/s 600 500 400 300 200 100 焱融 厂商-U 厂商- 厂商-H 厂商-N

OCR:IMG:存储集群性能(Checkpoint70B) 600 539GiB/s 500 400 314GiB/s 300 200 100 焱融 厂商-U 厂商- 厂商-H 厂商-N 读带宽 写带宽

OCR:IMG:YRCache分层异构缓存架构 G1:GPU显存 G1 GPU显存:保留最活跃的KVCache数据,确保最高速度的访问 G2:主机内存 G2 主机内存:存储当前热数据,实现纳秒级最低延迟,承接亮频次访问,保障核心计算性能 YRCache优先利用用户精确控制CPU内存的占用比别,避免影响主机其他退程,提供了级佳的灵活性与安全性 G3:本地NVMeSSD G3 NVMeSSD:支持配置多块NVMe,提供更大的缓存容量,通过条带化等方式聚合VO带宽 个碰盘的吞吐瓶颈,为海量KVCache提供高性能、低延迟的次级 G3.5:YRCacheContextBox一体机 G3.5 面向长上下文,多轮对话与AgenticAl,专门面向KVCache的 访问特征进行优化,为KVCache提供跨节点共享的上下文空间 焱融 焱融

OCR:IMG:2026年9月1日,全球权威A1性能评测组织 MLCommons正式发布MLPerfStoragev3.0 基准测试榜单。焱融全闪AI存储F9000X凭借 优异的软硬件架构和数据传输能力,性能再创 世界纪录。在3DU-Net模型训练测试中,三节 点存储集群聚合带宽达到584GB/s,近乎将高 速网络带宽全部打满;在Checkpoint70B测试 中,集群读、写带宽同样双双位列全球第一, 全面领跑全球AI存储赛道。 MLPerf是目前全球极具权威性和影响力的AI 性能基准测试体系,其测试结果被业内公认为 衡量AI硬件综合实力的“黄金标准”。本次 MLPerfStoragev3.0新增KVCache测试用 例,进一步扩展了其对AI全场景工作负载的覆 盖能力。 本次测试中,硬件集群环境由3台焱融 F9000X全闪存储节点和9台x86客户端服务

OCR:IMG:F9000X全闪存储节点和9台x86客户端服务 器组成,依托NVIDIAQM9700交换机实现 NDR400高速网络互联。每个F9000X存储节 点采用2U通用x86服务器平台,搭载英特尔 至强?6900P(GraniteRapids,GNR-AP)处 理器、PCleGen5NVMeSSD闪存及4块 NVIDlAConnectX-7400GbpsInfiniBand网 卡,构建高带宽、低时延的全闪存储测试环 境。 GraniteRapids处理器作为英特尔新一代数据中 心平台,不仅提供更强的核心性能和1/O吞吐 能力,还支持MRDIMM(MultiplexedRank DIMM)高性能内存技术,将单条内存速率提升 至8800MT/S,在元数据管理、并发1/O调度、 Checkpoint处理以及KVCache等AI存储关 键场景中显著降低内存访问瓶颈。GNR-AP与 MRDIMM的结合,为YRCloudFile并行文件系 统提供了更强的数据处理能力和更高的存储访 问效率,进一步释放PCleGen5SSD与400G

OCR:IMG:规代有美宝效拍之生拍为情更商P特增用 问效率,进一步释放PCleGen5SSD与400G 网络的性能潜力。 1训练场景极致吞吐:584GB/s满带宽输 出,斩获全球第一 作为AI训练场景中对存储带宽、数据吞吐能力 诉求最严苛的测试项,3DU-Net模型训练极度 考验存储系统的持续带宽输出能力和极限负载 稳定性。本次v3.0测试中,焱融F9000X三节 点全闪存储集群聚合带宽544GiB/s,近乎将高 速网络带宽全部“打满”,斩获该场景性能第一。 这充分验证了焱融全闪F9000X在极限AI训练 负载下对高速网络带宽的高效利用能力,能够 以更少的存储节点释放更强的数据供给能力, 满足大规模AI训练对高带宽存储的需求。同 时,极致的带宽利用率,不仅意味着更高的 GPU数据供给效率,更意味着企业能以更少的 存储节点支撑更大的AI算力规模,从而降低整

OCR:IMG:存储节点支撑更大的AI算力规模,从而降低整 体存储成本。 这一成绩的背后,是焱融对AI存储软硬件协同 优化的持续投入。从MLPerfStorage历届测试 结果来看,在3DU-Net场景中,焱融持续刷新 AI存储性能纪录:从v2.0的478GiB/s,到本 届v3.0的544GiB/s,不仅创下焱融自身历史 最高成绩,同时在通用硬件环境下,也达到了 历届公开测试成绩中的最高水平。 高效断点续训l:Checkpoint7OB场景读写 双冠 在Checkpoint7oB测试中,焱融存储集群实现 539GiB/s的读带宽和314GiB/s的写带宽,读 写性能均位居全球第一,双双刷新历届MLPerf Storage公开测试成绩最高水平。优异的断点 读写性能,可极大缩短千亿级万亿级大模型训 练的存档与恢复耗时,有效规避训练中断导致

OCR:IMG:练的存档与恢复耗时,有效规避训练中断导致 的算力浪费与时间损耗,显著提升大规模大模 型训练的连续性与稳定性,全方位保障AI大模 型高效训推的核心需求。 1从训练到推理,G3.5共享缓存加速Token 生产 值得关注的是,随着大模型加速迈向长上下 文、高并发与Agent推理,KVCache正成为 影响推理效率的关键数据资源。MLPerf Storagev3.0首次新增KVCache推理工作负 载,也进一步体现了存储在大模型推理基础设 施中的重要性。本次测试中,焱融全闪 F9000X实测达到读带宽288GiB/s、写带宽 60GiB/s,验证了其面向KVCache高并发卸载 与快速回读的数据支撑能力。 面向推理时代不断增长的KVCache存储与复 用需求,现有G1-G4缓存分层逐渐面临容量有

OCR:IMG:用需求,现有G1-G4缓存分层逐渐面临容量有 限、跨节点难共享、缓存复用效率不足等挑 战。对此,焱融科技进一步推出了YRCache ContextBox一体机,构建G3.5专属共享缓存 层,为KVCache提供跨节点共享的高速上下 文空间。结合焱融YRCache推理存储系统, 实现KVCache在不同存储层级间的统一管 理、智能调度与高效流动,减少重复计算与 GPU等待,高效支撑长上下文、高并发、 Agent推理及Token工厂等新型Ai推理场景。 I焱融全栈AI存储,持续释放GPU算力价 值,加速AI规模化落地 从MLPerfStoragev1.0、v2.0到最新的 v3.0,测试的AI工作负载不断演进,焱融全栈 AI存储技术也在持续突破升级一一从高性能 全闪存储,到YRCache推理存储系统,再到 YRCacheContextBox一体机,焱融科技构建 起了覆盖AL全流程的数据基础设施能力、而每

OCR:IMG:YRCacneContextBox一体机,规融科技构建 起了覆盖AI全流程的数据基础设施能力。而每 次MLPerf基准测试的结果,也充分证明了焱 融存储面向多元AI工作负载的技术实力。未 来,焱融将持续围绕算力、存力与网络协同, 针对AI训练、推理及新型数据工作负载不断优 化存储基础设施,以高性能、高效率的数据底 座释放GPU算力价值,助力AI应用深入发 展。 此次MLPerfStoragev3.0测试成绩的取得,也 离不开产业链生态伙伴的大力支持。特别感谢 英特尔公司为系统提供的关键核心支撑,同时 感谢新华三、浪潮、云尖信息、华勤、同泰怡 等服务器合作伙伴,以及Solidigm、忆恒创源 等企业级NVMeSSD和英伟达高性能网络设备 对焱融参与本次基准测试提供的硬件支持。未 来,焱融也将继续携手生态合作伙伴,持续攻 坚AI存储核心技术,不断突破性能边界。

本栏目中的所有页面均系自动生成,自动分类排列,采用联索网络信息采集、网页信息提取、语义计算等智能搜索技术。内容源于公开的媒体报道,包括但不限于新闻网站、电子报刊、行业门户、客户网站等。使用本栏目前必读