来源 :量子位2026-09-04
9月3日,趋境科技与摩尔线程签署战略合作协议。此次合作以趋境科技自研的国产 PD 异构技术与摩尔线程 MTT S5000 智算卡与 MUSA 软件平台的深度融合为基础,双方将持续推进基于趋境科技 ATaaS 平台的国产化高品质 AI Token 工厂建设,并共同研发和推广以 Token Pod(Token 超节点)为载体的联合解决方案。目前,相关方案已投入生产,并承接头部模型厂商官方业务的真实 Token 流量。在同等生产服务标准下,该方案兼顾国产算力的生产级性能与单位 AI Token 成本优势,整体性价比超越国际先进算力方案。这一进展也标志着趋境科技携手摩尔线程,率先推动国产 PD 异构推理进入生产环境。趋境科技 Token 事业部总经理刘显赫、摩尔线程战略销售事业部副总经理费靖然代表双方签署协议。清华大学教授、趋境科技首席科学家武永卫,趋境科技创始人兼 CEO 艾智远、总裁兼 CFO 武文洁、首席架构师谢威宇,摩尔线程创始人、董事长兼 CEO 张建中,高级副总裁董龙飞、高级副总裁罗文勇等出席签约仪式。
国产卡跑出高品质 AI Token 生产级性能性价比超越国际先进算力.随着大模型应用进入规模化商业落地阶段,基础设施的竞争正在从单卡性能转向系统级 Token 生产效率。衡量一套方案商业价值的关键,不只是硬件能否运行模型,还要衡量在既定服务目标下,每一枚高品质 AI Token 的生产成本。趋境科技与摩尔线程联合方案的性价比优势,并不简单来自硬件价格差异,而是源于对 Prefill 与 Decode 两个阶段的资源优化。由摩尔线程 MTT S5000 负责 Prefill 阶段的输入计算与 KV Cache 生成,与承担 Decode 阶段Token生成的高带宽 GPU 协同工作。MTT S5000 凭借高密度 AI 算力、原生 FP8 精度,以及 MUSA 完善的软件栈与生态适配能力,支持 Prefill 从传统推理链路中解耦,构建为可独立供给、独立计费、独立优化的算力资源池。趋境科技依托自研国产 PD 异构技术完成模型深度优化和跨设备协同,最终将不同类型的算力资源整合为统一、稳定的、高性价比的端到端推理服务。这种配置减少了 Prefill 阶段对高成本资源的占用,也避免按照单一阶段的峰值需求配置整套基础设施。在当前项目同等生产服务标准下,由 4 至 5 台 MTT S5000 组成的 Prefill 资源池,输入 Token 处理性价比超过国际先进算力方案。这意味着,国产算力的竞争力正在从单卡性能延伸至系统级 Token 生产效率。通过国产硬件与 PD 异构技术的深度协同,趋境科技与摩尔线程为万亿参数大模型的规模化推理提供了一条兼顾生产级性能与成本效率的国产算力路径。从“实验环境验证”走向“规模化生产落地”.性价比是否成立,最终仍要由真实业务检验。生产环境需要面对高并发、超长上下文和持续流量波动等复杂要求,这对国产算力的显存管理、跨设备协同和服务稳定性提出了更高要求。生产运行数据显示,摩尔线程 MTT S5000 与趋境科技自研国产 PD 异构方案协同运行,在国产头部大模型复杂的业务场景下,以平均超过 50 TPS 的生成速度、超 90%的 KV Cache 命中率、99.9%的稳定性,以及生产级低首 Token 时延(TTFT)保障,真正将国产算力转化为规模化、高品质 AI Token 生产能力。在趋境科技与摩尔线程多轮性能迭代和专项优化下,MTT S5000 跨过模型兼容和测试验证阶段,正式进入高品质 AI Token 生产链路。“少模型、深优化”理念持续验证.上述生产成果,也是趋境科技“少模型、深优化”技术路线的一次集中体现。通过围绕重点模型持续优化,趋境科技将国产 GPU 的硬件能力转化为稳定、可交付的 AI Token 生产能力。形成可复用的生产能力。趋境科技所坚持的“少模型、深优化”,是将核心工程聚焦具有明确规模化需求的重点模型,围绕模型、芯片、推理系统和真实业务负载开展持续优化。其最终衡量标准,是能否在实际运行中兼顾时延、吞吐、稳定性、精度、长上下文处理与成本,持续产出高品质 AI Token。这一理念也贯穿本次国产 PD 异构方案的设计与落地。趋境科技根据 Prefill 与 Decode 不同阶段的任务特征完成 PD 分离异构推理方案设计,并与摩尔线程共同完成 MTT S5000 与模型、推理系统及运行环境的深度优化。双方以线上流量持续检验优化效果,并依据运行结果迭代模型配置和服务策略,使性能提升从实验参数转化为稳定的高品质 AI Token 产出,进一步验证了“少模型、深优化”在国产异构生产场景中的有效性。在此过程中形成的模型配置、流量特征和运行策略,进一步沉淀到 ATaaS 平台,形成可复用的生产能力。强强联合打造国产化高品质 AI Token 工厂.趋境科技与摩尔线程此次战略合作的核心目标,在于充分发挥双方在推理系统、生产运营与国产 GPU 软硬件平台方面的优势,共同建设能够承接真实业务、持续生产高品质 AI Token 的国产化 AI Token 工厂。围绕这一目标,双方将共同推出基于 Token Pod(Token 超节点)的软硬一体化 Token 生产解决方案。摩尔线程提供 MTT S5000 智算卡与 MUSA 软件平台,趋境科技以 Token Pod 为交付载体,将相关硬件与自研国产 PD 异构推理系统、ATaaS 平台及运营服务深度融合,形成覆盖基础设施、推理优化、平台管理和持续运营的专属推理集群。为推动联合方案从已投产项目走向标准化交付,双方将把国产 PD 异构项目中形成的模型适配、跨设备协同与生产运营经验进一步沉淀至 Token Pod。依托共享 KV Cache、流量感知配置、弹性扩展和故障隔离等能力,Token Pod 可适配国产与国际主流硬件组合,形成可根据业务需求配置和扩展的 Token 生产单元,加快联合解决方案在具体项目中的落地。相关方案的持续复制,建立在趋境科技既有的生产基础之上。截至2026年8月,趋境科技已完成日均万亿级高品质 AI Token 生产项目共建,并在多个项目中形成日均千亿级高品质 AI Token 生产能力,为双方进一步建设和运营更大规模的国产化高品质 AI Token 工厂积累了项目经验。作为国产异构混推的先行实践者,趋境科技以生产级标准推进国产 PD 异构方案落地,在保障功能与精度可信的基础上,持续开展深度引擎性能优化,让国产 GPU 的硬件能力真正转化为高品质 AI Token 产出。未来,趋境科技与摩尔线程将进一步深化技术联合、标准共建与生态协作,拓展在互联网企业、前沿基础模型公司、运营商等国家关键基础行业的合作,推动国产 PD 异构推理进入更广泛的生产应用场景。本文由趋境科技提供,量子位获授权转载,观点归原作者所有。举报/反馈