政策与产业共振,Token工厂进入商业化深水区
/传播易/9月9日,北京市发布《北京市“十五五”时期高精尖产业发展规划》,提出构建词元结算体系,打造覆盖词元生产、分发、消费等环节的全链条服务。此前,广东、内蒙古等地也相继落地Token贷,将Token(词元)消耗量纳入授信体系。
政策密集落地之下,Token正在从模型调用的计量单位,走向AI算力服务新的商业计价单位。随着大模型应用从训练转向规模化推理,算力需求开始更多对应实际Token消耗,算力服务商的竞争也由单纯提供GPU资源,延伸至Token生产效率、服务稳定性以及交付能力。
海外市场已经出现较为成熟的Token工厂形态。亚马逊云科技Amazon Bedrock围绕推理需求,将Token作为核心计量方式,推出Standard、Priority、Flex、Reserved等服务等级。CoreWeave今年3月推出推理平台CoreWeave Inference,其中Serverless Inference路径采用按Token计费模式,目前该平台ARR 从 2026 年一季度末的约100万美元增至二季度末的超1亿美元。Nebius则直接将推理平台命名为“Token Factory”,支持60余款开源模型,并通过收购Eigen AI强化推理优化能力。
国内Token工厂大多仍处于商业模式探索阶段,从算力基础设施建设到API服务,不同项目的推进路径并不相同。超讯通信5月宣布与南一智能联合共建Token工厂,7月上线Token云API智能分发与计费平台,目前仍处于试用测试阶段。弘信电子则在无锡布局Token工厂,并于8月完成首单Token跨境服务,但其已签约的97亿元订单仍以算力资源综合服务为主。
将 Token 计费纳入正式合同并实现交付,被视为检验这一模式商业化成色的关键节点。综合国内公开信息来看,目前跨过这一节点的国内算力服务商仍屈指可数,行云科技是其中之一。7月,行云科技与国内一家头部长文本大模型客户签署的补充协议,新增"Token收入相关固定服务费"条款,成为A股首单以正式公告形式将Token计费写入合同的算力服务重大合同。9月,行云科技进一步披露,"Token工厂"模式对应的按Token计量的算力服务,首批算力单元已完成交付验收。
这意味着,Token工厂的商业化模式已进入实际履约阶段。对于算力服务商而言,真正的考验也由算力资源储备转向能否持续将算力转化为可交付、可结算的Token服务,这也是TaaS模式的核心。
综合公开信息来看,TaaS链路涉及IaaS、MaaS、AaaS三个环节,国内厂商目前的布局各有侧重。
IaaS侧主要解决算力资源供给。阿里云、腾讯云、火山引擎等云厂商依托自有云基础设施提供规模化算力,并行科技、行云科技等则通过整合算力资源和建设区域节点参与市场竞争。据多方消息,行云科技在北京规划落地约3万P算力,约占北京2026年下半年计划新增5万P算力的六成。
MaaS侧的竞争更多集中于模型适配和推理效率。硅基流动目前支持超过170款模型,并提供多架构算力接入和推理加速服务。行云科技引入AlayaJet推理引擎,优化提高Token生产效率,相比开源推理引擎吞吐量TPS提升44%,首字等待时延降低28%。
AaaS侧则更接近Token的实际消费端。随着Agent、具身智能等应用发展,模型调用从单轮交互向持续任务执行演进,对Token的消耗也随之增加。无问芯穹已将企业级智能体和具身智能纳入其基础设施产品体系。硅基流动也将Agent、Coding等列为重点应用场景。行云科技则通过投资具身智能企业光象科技,并布局Agent相关场景向应用需求侧延伸。
整体来看,不少厂商仍集中在其中某一环,行云科技的布局则相对延伸得更完整一些,算力资源、推理服务与应用场景均有覆盖,不过各环节的实际成效仍有待后续数据验证。
过去市场更关注算力厂商的硬件规模,如今更需要关注的是,这些算力能够生产多少有效Token、服务多少真实需求,以及最终能否形成可持续兑现的Token收入。从这个意义上看,Token工厂正在成为算力行业从资源竞争走向服务能力竞争的重要分水岭,而能率先完成TaaS全链路建设并实现签约、交付和结算闭环的厂商,也更有机会在这一轮商业模式切换中占据先发位置。

分享








