Rain科技7月19日消息,据媒体报道,在2026世界人工智能大会(WAIC)现场,国产GPU厂商摩尔线程首次公开展出了其最新产品——MTT C256超节点。该产品专为大规模AI训练与推理设计,展现了摩尔线程在高性能计算领域的持续突破。
该超节点采用创新架构,首创单层Scale-up网络,能够在标准单宽机柜内实现128卡全互联,并柜扩展后更可达256卡极速互联,有效解决了传统多层网络架构中带宽损耗与高延迟的痛点。这一设计大幅降低了通信瓶颈,对于大规模分布式训练的效率提升具有重要意义。
MTT C256采用计算与交换一体化的高密设计,可显著提升智算中心GPU部署密度,为万卡乃至十万卡级超大规模长稳训练与推理集群打造坚实的算力底座。与传统方案相比,其集成度更高,能耗更低,为数据中心节约了宝贵的空间和电力资源。
该超节点具备三大核心优势:
高密度部署:单机柜GPU密度领先,两柜即可实现256卡一层Scale-up全互联,大幅节省机房空间。同时,这种高密度设计也缩短了卡间物理距离,进一步降低了通信延迟。
极致互联性能:单层Scale-up网络支持256卡全互联,卡间通信延迟压至亚微秒级,带宽利用率更高,为并行策略优化提供更大空间。这对于当前大模型训练中的张量并行、流水线并行等策略尤为关键。
生态兼容性:2U节点设计兼容现有智算软硬件生态,支持从万卡向十万卡集群平滑扩展,降低了用户迁移成本,加速了国产算力生态的成熟。
产品主要面向三大应用场景:
训练(Model Factory):作为十万卡集群核心组件,支撑大模型预训练、后训练与强化学习。其强大的通信能力确保了训练过程的稳定性和效率。
推理(Token Factory):原生支持大规模MoE架构与百万级超长上下文推理,具备低延迟、高吞吐能力,能够满足日益增长的复杂推理需求。
推理解码(Agent Factory):支持高并发场景,单用户输出速度可超100 token/s,适用于AI Coding等对实时性要求极高的应用,为智能代理的广泛部署提供了算力基础。
MTT C256超节点的真正壁垒,在于背后经过验证的工程化体系。通过高效液冷散热、三盲插设计、完善的RAS机制与集群管理系统,产品在大规模部署下的稳定性与可维护性得到有效保障。这套能力源自摩尔线程在真实万卡级训练环境中沉淀的产品化经验,而非单纯的概念堆砌。值得关注的是,这种工程化经验是当前国内GPU厂商缩小与国际领先水平差距的关键所在。
