三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

云南GPU 万卡商用集群正式落地昆明 悍铭智算中心完成二期扩建

云南GPU 万卡商用集群正式落地昆明 悍铭智算中心完成二期扩建

云南GPU万卡商用集群正式落地昆明 悍铭智算中心完成二期扩建

昆明讯:深耕IDC与云计算二十余年的悍铭集团(HanMingGroup)今日宣布,其昆明AI算力中心二期扩建工程竣工,10000卡规模商用GPU集群正式全量点亮投运。这是由民营科技企业自主建设、面向商用市场开放的万卡级人工智能算力集群,标志着西南地区智算基础设施从“千卡训练级”跨入“万卡大模型级”供给新阶段。

据悉,该集群在此前2026年7月“云南千卡商用GPU集群”点亮的基础上,于三个月内完成二期扩容,最终形成单池10000张NVIDIA高性能GPU(含Blackwell/B300/H200等架构混合部署)的统一调度资源池,配套100TB/s级高速互联、PB级并行存储及全栈自研算力管理平台,集群服务可用性达99.99%。

从千卡到万卡:西南智算底座再跳级

悍铭集团相关负责人表示,千卡集群解决的是“本地有没有大模型算力”的问题,万卡集群解决的是“区域能不能跑千亿参数级预训练”的问题。“昆明节点现在可以稳定支撑千亿到万亿参数大模型的完整训练—微调—推理闭环,也能切分给上百家企业做中小模型微调与AIGC推理,资源利用率通过自研平台做到动态削峰。”

扩建后的集群依托悍铭昆明自建三线IDC机房(电信/移动/联通骨干直连、双路市电+UPS+柴发、液冷预埋、高功率机柜),结合昆明年均温低的天然优势,整体PUE控制在行业第一梯队,兼顾大模型训练的高负载与绿色低碳诉求。

自研平台承接万卡调度与堆卡同步完成的,是悍铭全栈自研AI算力管理平台的万卡化升级:支持Kubernetes/Slurm双引擎编排、多租户强隔离、RDMA/IB胖树互联、任务级故障漂移与按卡时弹性计费。客户可从“单台8卡机”平滑扩展到“跨节点万卡任务”,分钟级创建环境,无需自维底层硬件。

目前该集群已面向四类场景开放商用:

大模型预训练/SFT/RLHF(DeepSeek、Llama、GPT级)

多模态与视频生成(Diffusion、DiT、vLLM/TensorRT-LLM推理)

科学计算(GROMACS、OpenFOAM、Gaussian)

自动驾驶仿真、工业CAE、量化金融回测

区域与跨境双辐射

作为国家高新技术企业、云南省专精特新企业,悍铭将以昆明万卡集群为枢纽,承接省内高校科研、AI企业训练需求,同时面向南亚东南亚跨境数字经济提供低时延、合规化智算出口。集团此前已与中国电信、中国移动、中国联通建立深度合作,并形成“AI算力+公有云+IDC托管”的全栈数字基础设施能力。

业内人士指出,在西部算力节点普遍仍处于“千卡试点”的当下,云南率先落地民营万卡商用集群,不仅补强了“数字云南”的智算供给厚度,也为大模型公司“东训西移”提供了可替代一线云厂商的第三方选择。

← 返回列表