国产的高品质AI Token工厂是怎样的?这两家龙头联手打了个样
来源:广州日报
国产的高品质AI Token工厂是怎样的?这两家龙头联手打了个样
9月4日,摩尔线程宣布,已经与趋境科技签署战略合作协议。双方将以摩尔线程MTT S5000智算卡与MUSA软件平台为基础,深度融合趋境科技自研国产PD异构技术,持续推进和扩大基于ATaaS平台的国产化高品质AI Token工厂建设,并共同联合研发和推广以Token Pod(Token 超节点)为载体的联合解决方案。
目前,相关方案已投入生产,并承接头部模型厂商官方业务的真实Token流量。在同等生产服务标准下,该方案兼顾国产算力的生产级性能与单位AI Token成本优势,整体性价比超越国际先进算力方案。这一进展也标志着摩尔线程携手趋境科技,率先推动国产PD异构推理进入生产环境。摩尔线程全功能GPU也成功跑通“从规模化Token生产到真实业务应用”的全流程闭环。
国产卡AI Token“产线”性价比超越国际先进算力
随着大模型应用进入规模化商业落地阶段,基础设施的竞争正在从单卡性能转向系统级 Token 生产效率。衡量一套方案商业价值的关键,不只是硬件能否运行模型,还要衡量在既定服务目标下,每一枚高品质AI Token的生产成本。
摩尔线程与趋境科技联合构建了PD分离异构推理架构:由摩尔线程MTT S5000负责Prefill阶段的输入计算与KV Cache生成,与承担Decode阶段Token生成的高带宽GPU协同工作。在这套架构里,MTT S5000凭借高密度AI算力、原生FP8精度,以及MUSA完善的软件栈与生态适配能力,支持Prefill从传统推理链路中解耦,构建为可独立供给、独立计费、独立优化的算力资源池。趋境科技则通过依托PD异构推理系统实现KVCache 的跨设备高效流转,最终将不同类型的算力资源整合为统一、稳定的、高性价比的端到端推理服务。
双方联合方案的性价比优势,不仅来自硬件价格差异,而是源于对Prefill与Decode两个阶段的资源优化。在当前项目同等生产服务标准下,由4至5台MTT S5000组成的Prefill资源池,输入Token处理性价比超越国际先进算力方案。
强强联手打造国产化高品质AI Token工厂
摩尔线程相关负责人表示,与趋境科技的此次战略合作,有望充分发挥双方在国产 GPU 软硬件平台、推理系统与生产运营方面的优势,共同打造可稳定承接真实业务流量、持续输出高品质AI Token的国产化 AI Token 工厂。
围绕这一目标,双方将联合推出基于Token Pod(Token超节点)的软硬一体化Token 生产解决方案。摩尔线程提供MTT S5000智算卡、后续更高性能GPU产品及MUSA软件平台;趋境科技以Token Pod为标准化交付载体,融合自研国产PD异构推理系统、ATaaS平台与运营服务,构建覆盖算力基础设施、推理优化、平台管理及持续运营的专属推理集群。
基于双方已投产项目的实践经验,联合方案将进一步沉淀模型适配、跨设备协同和生产运营能力,并标准化集成至Token Pod。依托共享 KV Cache、流量感知配置、弹性扩展及故障隔离等能力,Token Pod 可适配国产及国际主流硬件组合,形成可按业务规模灵活配置、按需扩展的 Token 生产单元,加速在具体生产项目中的部署与落地。
摩尔线程相关负责人展望,双方未来将持续深化技术联合、标准共建与生态协作,拓展在互联网企业、前沿基础模型公司、运营商等国家关键基础行业的合作,推动国产PD异构推理在更多生产级场景中规模化应用。
文/广州日报新花城记者:钟达文
广州日报新花城编辑:李光曼
(来源:广州日报 编辑:张明艳)