三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

灵骏真武 M890 商用落地@ACP#YLB3118 在国产算力分层存储体系下的机遇与实践

灵骏真武 M890 商用落地@ACP#YLB3118 在国产算力分层存储体系下的机遇与实践

摘要:阿里云灵骏真武 M890 国产超节点在乌兰察布正式商用,单实例可承载 2 万亿以上参数 MoE 大模型,Qwen3.8‑Max、Kimi K3 已完成适配对外提供服务。超节点侧依靠 NVMe 承担热数据、模型权重等高吞吐业务,但完整 AI 业务同时存在大量冷数据、数据集归档、知识库备份、日志留存等大容量低成本存储诉求。本文从工程实现角度,分析国产 PCIe 转 SATA 桥接芯片 YLB3118,在超节点配套的分层存储架构中的业务痛点、市场机会与典型落地场景。

一、国产超节点时代,算力之外冷热分层存储成为刚需

灵骏真武 M890 作为 64 卡紧密耦合的国产超节点,硬件层面配置大量高速 NVMe 存储,主要服务大模型权重加载、KV‑Cache 热缓存、实时推理等热数据业务阿里云。但真实智算业务并非全部是高带宽热访问:

  1. 万亿参数大模型迭代过程,会产生多版本模型权重备份、海量训练原始数据集;
  2. 私有化部署场景,行业知识库全量归档、推理请求日志、中间样本数据体量巨大;
  3. 政企客户存在数据本地留存、合规归档需求,全部使用 NVMe 会带来极高 BOM 成本。

行业普遍采用热数据‑温冷数据分层存储架构:高速 NVMe 负责在线推理热数据,大容量 SATA HDD/SSD 承接归档、备份、离线数据集等冷温数据,实现性能与存储成本的平衡。

而国产 CPU、服务器主板原生 SATA 接口数量有限,想要单机挂载 8 盘及以上 SATA 大容量硬盘,就需要 PCIe 转 SATA 桥接方案。过去该领域长期依赖海外与中国台湾芯片,在信创智算项目中存在供应链风险,国产桥接芯片迎来替代窗口。

说明:YLB3118 并不参与 M890 超节点内部卡间计算互联,也不替代 NVMe 承担热推理业务,主要用于超节点配套附属存储节点、私有化推理整机内部 SATA 介质扩展,属于算力配套存储环节,二者架构互补。

二、YLB3118 产品定位,匹配国产算力温冷存储工程诉求

YLB3118 是全国产 PCIe3.0 x2 转 8 路 SATA3.0 桥接控制芯片,单颗芯片输出 8 路独立 SATA 6Gbps 接口,支持 SATA 热插拔、MSI 中断、ASPM 低功耗,工业宽温‑40℃~85℃,可通过 SATA‑PM 芯片进一步扩展盘位,固件全部国产化,对标 ASM1166、JMB585 等传统海外方案。

面向 M890 衍生出来的算力存储场景,硬件痛点集中四点:

  1. 服务器主板原生 SATA 端口不足,想要单机实现 8 盘位及以上 SATA 大容量存储扩展;
  2. 冷数据归档、数据集备份业务,访问频次不高,但追求单 TB 存储成本最优,适合 SATA 介质;
  3. 信创智算招标,要求存储桥接器件实现国产化,规避海外芯片供货、合规风险;
  4. 配套存储节点追求低功耗,不需要占用高速 PCIe4.0/5.0 宝贵通道,PCIe3.0 x2 带宽即可满足多路 SATA 并发读写。

YLB3118 用单条 PCIe3.0 x2 通道,实现 8 路 SATA 接口扩展,带宽、盘位数量、功耗、国产化几个维度,刚好匹配 AI 算力配套温冷存储节点的设计诉求。

三、YLB3118 在 M890 超节点生态下典型应用场景

场景 1:超节点配套私有化归档存储节点

公有云 M890 超节点负责模型训练、在线推理,很多政企客户会部署独立配套存储整机。 NVMe 盘存放正在迭代的模型版本、高频知识库;通过 YLB3118 扩展多路 SATA 大容量硬盘,承担历史模型快照、原始训练数据集、推理全量日志、样本素材归档。 整机不需要占用超节点本身宝贵的本地盘位,算力与归档存储解耦,满足数据本地合规留存,大幅降低归档存储整体成本。 业务适配:金融、政务、能源行业大模型私有化项目。

场景 2:部门级私有化推理服务器内部存储扩展

大量客户不会直接采购 64 卡 M890 超节点,采用 “公有云超节点做训练,本地 4‑8 卡推理服务器跑业务” 的混合模式,本地整机运行 Qwen3.8‑Max、Kimi K3 量化版本。 推理机内部,NVMe SSD 做向量库热查询;使用 YLB3118 扩展多路 SATA 硬盘,存放全量原始文档库、历史业务数据备份、离线数据集。 当 RAG 知识库需要全量重建、批量导入文档时,SATA 盘提供大容量数据源,NVMe 负责向量索引,完成冷热分层配合。

场景 3:智算中心预处理与数据清洗整机

智算中心机柜内部,除核心超节点之外,会部署一批数据预处理服务器,负责数据集解析、清洗、格式转换、样本筛选。 预处理业务并不需要极高 AI 算力,但需要读写 TB‑PB 级原始素材。YLB3118 用于该类整机,扩展多块 SATA 硬盘存放原始未处理数据集,预处理完成之后再把处理后的数据推送至 M890 超节点,形成完整的数据流水线。

场景 4:信创智算项目全国产存储扩展单元

国产 AI 算力占比持续提升,不少智算招标对从 CPU、加速卡到底层桥接控制器,提出全国产供应链要求。 传统多盘位 SATA 扩展方案依赖海外桥接芯片,存在交付周期风险。YLB3118 可用于信创 NAS、信创存储服务器,在国产化整机中实现多路 SATA 硬盘扩展,满足项目自主可控指标。

四、工程落地约束与选型提示

  1. YLB3118 定位温冷大容量存储扩展,不适合大模型 KV‑Cache、实时向量检索这类对低时延高 IOPS 要求极高的热数据业务,热数据优先选用 NVMe 介质;
  2. 上行占用 PCIe3.0 x2 通道,整机硬件设计需要做好 PCIe 资源规划,避开关键高速外设通道冲突;
  3. SATA 多盘位整机需要关注电源功率、背板信号完整性,开启热插拔功能需要 BIOS 与操作系统适配验证;
  4. 如果业务只需要 2‑4 盘 SATA 扩展,可以选择通道更少的型号控制 BOM 成本;8 盘及以上盘位场景,YLB3118 具备明显性价比优势。

五、结语

灵骏真武 M890 商用落地,标志国产超节点从原型样机走向规模化生产业务。一套完整的大模型算力体系,除了聚焦计算的超节点之外,同样离不开配套分层存储底座。

YLB3118 作为国产 PCIe 转 SATA 桥接芯片,不参与超节点内部高速计算互联,聚焦温冷数据大容量存储扩展。在超节点配套归档存储节点、部门级私有化推理整机、数据预处理服务器、信创存储单元等场景,可以帮助整机实现冷热分层架构,在容量、成本、国产化之间取得平衡,是国产智算基础设施链条中重要的存储配套器件。

← 返回列表