大模型应用一旦进入规模化,基础设施竞争就会从「单卡跑不跑得动」滑向「每一枚高品质Token的生产成本」。9月3日,趋境科技与摩尔线程签署战略合作协议:以趋境自研国产PD异构技术,深度融合摩尔线程MTT S5000智算卡与MUSA软件平台,共同推进基于ATaaS平台的国产化高品质AI Token工厂,并以Token Pod(Token超节点)作为联合交付载体。
趋境科技聚焦推理系统与Token生产运营,公开强调「少模型、深优化」——围绕有明确规模化需求的重点模型,把芯片、推理引擎与真实负载一起打磨。摩尔线程是国产GPU与MUSA软件栈厂商,MTT S5000面向智算场景,强调高密度算力、原生FP8与生态适配。签约现场公开出席名单包括趋境创始人兼CEO艾智远、首席科学家武永卫,以及摩尔线程创始人、董事长兼CEO张建中等。
方案与生产口径:
所谓PD异构,白话是把「读懂长上下文、写好KV」和「一个个吐字」拆到不同算力池,用更合适的卡干更合适的活;所谓AI Token工厂,白话是按服务等级协议持续、稳定地「生产」可计费推理输出,而不是实验室跑通一次Demo。对采购方,验收应从单卡基准转向端到端时延、命中率、稳定性与单位Token成本。
放在国产算力上下文里,长期叙事偏「能不能训起来」;推理侧一旦日均走到千亿、万亿Token,真正卡脖子的是Prefill成本与混部运维。趋境公开称截至2026年8月已完成日均万亿级高品质Token生产项目共建,并在多个项目形成日均千亿级生产能力——这为Token Pod标准化复制提供了项目土壤。双方拟把模型适配、跨设备协同与运营经验沉淀进Token Pod,形成可按业务扩展的生产单元。
产业影响上,若PD异构混推成为政企与模型厂默认路径,国产GPU进入生产环境的门槛会从「替代整卡」变成「先吃Prefill」。需要把边界读清楚:性价比与TPS等为合作双方公开口径,不同模型与负载不可直接外推;「超越国际先进」是在既定服务标准下的对照表述。下一观察点是Token Pod标准化交付节奏,以及更多头部流量是否持续迁入。