中国力量闪耀MLPerf!泛联信息强势包揽7项世界第一引领AI存储新时代!
- 2026-07-29 14:48:00
- miadmin 原创
- 13
北京时代8月4日23时,正在环球巨擘 AI 基准测评构制 MLCommons® 正式公布的MLPerf® Storage v2.0存储功能基准测试结果中,深圳市泛联消息科技有限公司(UBIXTechnologyCo.,Ltd.)加入了全数10项场景测试,博得7项宇宙第一。这一收获不但彰显了泛联消息(UBIX)正在高功能全闪存储体系周围的工夫领先身分,也外现了其产物正在支柱大领域AI练习与推理职分中的超卓本事。
MLPerf® Storage v2.0 是由环球巨擘 AI 基准测试构制 MLCommons® 推出的最新一代人工智能存储功能评测圭臬,旨正在量度正在确凿 AI 事业负载下,存储体系对练习与推理流程的撑持本事。动作特意面向 AI 时期的数据聚集型利用打算的评测套件,MLPerf® Storage v2.0 不但夸大含糊带宽、IO 含糊量等守旧功能目标,更着重于正在大领域并发、海量数据执掌、大模子练习、Checkpoint存储及光复等楷模场景中的体系发扬。
本次测试吸引了环球 26家顶尖科技企业加入,笼罩存储体系、AI 根底办法及半导体三大焦点周围,加入者既包含泛联消息(UBIX)云云的革新力气,也涵盖 IBM、Huawei、HPE、DDN、Intel、Samsung、Micron、Kioxia、Lightbits Labs、H3C、Oracle、Nutanix 等行业标杆企业,充实呈现了该基准测试正在环球科技周围的普通承认度与影响力。

MLPerf® Storage v2.0正在2023年0.5版本及2024年1.0版本6个练习场景的根底上,填补了4个基于区别领域llama3模子的checkpoint测试场景,笼罩了从样本加载、checkpoint存储与光复等常睹模子练习场景的事业负载,所有测评图像识别、科学筹划等周围人工智能利用的存储需求,确保评测结果具有普通的实际参考事理。
MLPerf® Storage v2.0 针对A100和H100两种GPU分裂界说了3D Unet 、ResNet50和CosmoFlow 3个模子下一共6类练习测试场景,从下外中可能看到每个测试场景的模子简介、练习框架及测试条目等要害消息:

MLPerf® Storage v2.0中新增了4个Checkpoint测试场景,用于模仿 AI 模子练习流程中的模子checkpoint存储与光复事业负载。这些测试场景聚焦于checkpoint高带宽写入和读取功能,笼罩了区别领域模子练习中常睹的I/O模子,从下外中可能看到每个测试场景的参数领域、checkpoint测试数据量和楷模场景等要害消息:

同时,为了保障测试结果的无误性和巨擘性,MLPerf® Storage v2.0拟定了极其厉刻的测试标准,包含:
正在MLPerf® Storage v2.0中,许诺操纵更大领域的GPU模仿集群,进一步抬高了对体系高带宽与低延迟的条件。
Accelerator Number(ACC NUM):模仿测试练习GPU数目,量度体系执掌本事的领域;模仿测试练习GPU数目越众,对存储体系的读写带宽和并发含糊的压力越大。
Accelerator Utilization(AU):测试流程中 GPU 的均匀愚弄率(百分比),响应存储体系是否能为GPU供给稳固且赓续的数据需要。假设愚弄率低,注解存储功能不妨成为瓶颈。

Storage System RU:存储体系所占的物理空间,单元为 RU(Rack Unit,1RU = 1.75 英寸)。注:因为片面Cloud类型的参测厂商未反应现实操纵的存储体系RU数据,因而本文并未将这片面参测厂商的每存储体系RU输出带宽纳入比较。
基于上述目标维度,群众就可能对 MLPerf® Storage v2.0测试中各参测厂商的体系本事实行所有比较,比方:
正在满意官方条件的GPU 愚弄率下,哪个存储体系能撑持更高的GPU数目及更高的营业带宽?
正在相仿练习模子下,哪个存储体系的功能密度更高,即存储体系每RU输出的读、写带宽更高?
正在相仿checkpoint模子下,哪个存储体系的功能密度更高,即存储体系每RU输出的读、写带宽更高?
更高的功能密度,意味着相仿节点数和机排挤间下,体系可能撑持更众 GPU 筹划节点的练习职分。
泛联消息(UBIX)动作邦内独一所有加入 MLPerf® Storage v2.0 全数10项测试场景的革新型AI存储厂商,正在浩繁邦际领先参测企业中脱颖而出,斩获个中7项宇宙第一的超卓收获。同时,正在所加入的测试项目中,泛联消息(UBIX)相较于1.0版本的焦点测试目标,普及竣工了两倍以上的功能擢升,充实外现了其正在AI存储周围的工夫能力与赓续革新本事。
泛联消息(UBIX)操纵自研独立学问产权的UbiPower18000全闪存储产物加入测试。本次测试境况基于泛联消息策略协作伙伴新疆银丰智能算力工夫有限公司供给的优质AI算力、汇集平台搭修。平台整合高品德的AI算力资源与高速汇集架构,为本次测试供给了稳固牢靠的根底测试境况。正在存储介质方面,泛联消息选用了大普微Roealsen®R6系列PCIeGen5NVMeSSD,该产物正在一共测试流程中仍旧了超低的读写时延以及稳固的读写带宽,为高负载、聚集型练习场景供给了强有力的支柱。

接下来,咱们将对泛联消息(UBIX)UbiPower 18000分散式全闪存正在本次测试中的详尽功能数据实行深切解析,所有明白其正在智算练习营业测试场景中的发扬。让咱们一同睹证这款面向智能筹划场景全新打算的革新型 AI 分散式存储体系所带来的强劲功能攻击与打破性价钱。
正在 ResNet-50 模子模仿测试中,测试体系模仿图像分类职分,操纵天生的 ImageNet 气概图像数据集,并通过众并发读取的 I/O 模子实行评估。正在该测试场景下,仅由3个 2U存储节点构成的UbiPower 18000分散式存储体系,告捷支柱了模仿练习中众达 2160张H100 GPU的数据含糊需求,GPU愚弄率赓续仍旧正在90%以上,体系稳固带宽抵达374.57GiB/s,对应每存储体系RU的带宽高达62.43 GiB/s。同时,该体系告捷撑持了3120张A100 GPU的模仿练习需求,照旧仍旧GPU愚弄率领先 90%,体系稳固带宽为280.77GiB/s,对应每RU带宽高达46.8GiB/s。
正在本测试模子下,UbiPower 18000无论正在撑持的GPU数目、体系总带宽,如故每存储RU带宽,均为总共参测厂商中的最高值,充实外现了其正在执掌大领域数据集场景中的超卓本事。同时,正在紧凑的空间占用下,供给了更高的功能密度,证据UbiPower 18000能正在相仿节点数和机排挤间下,撑持更众 GPU 筹划节点的高效练习职分,具备极强的可扩展性与布置效能。

该测试模子模仿的是科学筹划类AI事业负载,测试模子遵循筹划节点内存容量动态天生2.6MB巨细的科学模仿数据文献,并采用并发读取的I/O模子实行练习评估。泛联消息(UBIX)所操纵的测试客户端内存设备为512GB,正在此根底上,测试措施共天生约1500众万个科学模仿数据文献,正在本项测试中数据集领域正在总共参测厂商中也是最大的。正在云云大领域的数据集条目下,UbiPower 18000分散式存储体系照旧外现出强劲的功能发扬:
正在该测试模子下,UbiPower 18000正在撑持的GPU数目、体系总带宽及每存储体系 RU带宽等焦点目标方面,均为总共参测厂商中的最高程度。即使正在更大领域的数据集和更高的 I/O 压力下,该体系照旧撑持远超其他厂商的GPU数目与集群带宽,充实呈现了UbiPower 18000正在科学筹划类AI练习负载场景下的优异功能和出众的可扩展本事。

该测试模子模仿医学影像肢解职分的楷模事业负载,紧要用于评估存储体系正在搀杂读取形式及中等文献巨细(约140MB)场景下的功能发扬。正在本模子下,UbiPower 18000 存储体系也外现出了超卓的功能本事:
面向336张A100 GPU的模仿练习职分,体系告捷满意了高强度的数据含糊需求;
正在该测试模子下,UbiPower 18000 所撑持的 GPU 数目、总带宽及每存储体系 RU 带宽均为总共参测厂商中的最高程度,充实浮现了其正在医学影像类AI负载下的领先功能与重大适合性。

Llama3 405b模子模仿的是企业或高校正在实行大领域模子练习时,众个GPU供职器同时实行checkpoint数据读写的楷模场景。正在MLPerf® Storage v2.0测试中,该模子模仿了512途并发写入、并发读取,每轮总数据量达5.29TB的checkpoint数据,要点评估存储体系的读、写带宽本事以及大领域筹划集群下的并发访候功能。
正在该测试模子中,由3个2U存储节点构成的UbiPower 18000存储体系发扬出众,每个存储体系RU稳固输出50.5GiB/s的读带宽和36GiB/s的写带宽,其读、写带宽密度正在总共参测厂商中均为最高。

Llama3-1t模子模仿的是超大领域AI根底办法场景下,众个GPU供职器并发实行 checkpoint的读写操作。该模子模仿了1024 途并发写入和读取,每轮总量高达18TB的checkpoint数据,进一步擢升了对存储体系并发访候本事和读写带宽的磨练。
正在此测试中,由 3 个2U存储节点构成UbiPower 18000存储体系,每个 RU 稳固输出54.7GiB/s的读带宽和36.3GiB/s的写带宽,再次改正了参测厂商中的读写带宽密度记实。

这些数据充实证据了UbiPower 18000正在大模子练习流程中checkpoint存储与加载场景下的优异功能发扬。同时,跟着节点数目的线性扩展,该体系还或许赓续擢升集群的具体读写带宽,所有满意大领域 AI 练习对存储体系的极致带宽需求。
动作一家专一于 AI 存储产物与处置计划的新兴厂商,深圳市泛联消息科技有限公司(UBIX Technology Co., Ltd.) 通过正在存储介质利用、体系架构及软件竣工等方面的赓续革新,告捷研发出具有自决学问产权的高功能分散式文献体系 UBIXFS。
上述革新明显擢升了存储体系具体功能,有用支柱智算、超算场景对存储体系的厉苛需求,成为推进 AI 工夫生长与落地的要害支柱力气。
目前,泛联消息(UBIX)革新AI存储产物已正在众个超算核心和智算核心竣工商用布置,普通利用于数据预执掌、海量数据访候、大领域checkpoint读写等要害场景,并正在科研、高功能筹划(HPC)、以及文本、图像、视频、众模态大模子练习等职分中外现出优异的功能发扬。
预测异日,泛联消息将赓续深耕 AI 存储周围,盘绕高功能、高牢靠性、智能化三大目标不绝加大研发加入,赓续优化体系架构与软件本事,推出更众面向大模子练习、智算与超算核心的领先产物与处置计划,助力环球用户高效应对 AI 时期的存储挑拨。
如需明晰 UBIX 产物更众消息及获取工夫撑持,敬请访候泛联消息官方网站
| 联系人: | 王先生 |
|---|---|
| 微信: | 1735252255 |
| 地址: | 沈阳市铁西区兴华南街58-6号 |
-
思陌产品
深度学习系统产品介绍 -
使用帮助
使用手册 -
关于我们
公司简介 -
资讯反馈
交流论坛 -
联系我们
Tel 15640228768 QQ/WX技术支持 1735252255