Token工厂为何受资本追捧?拆解魔形智能的商业样本
核心摘要:成立两年的魔形智能三个月内连融两轮,日均Token调用量达数万亿级,收入达数亿元。在开源模型大行其道的背景下,Token工厂为何成为资本新宠?本文从融资节奏、商业模式和市场逻辑三个维度拆解这一商业样本。
三个月连融两轮,资本在追什么?
2026年8月10日,魔形智能宣布完成A轮融资,由毅达资本领投,诚元祥投资、洪山资本、瑞锋资本等联合投资,达泰资本、香港科技园创投基金等老股东持续加注,部分老股东还进行了超比例跟投。这是该公司继今年5月公布数亿元Pre-A轮融资后,仅三个月内拿到的第二笔融资。
三个月连融两轮,在当前融资环境中并不多见。更值得关注的是其业务体量——成立两年,日均Token调用量已达数万亿级别,收入达数亿元,客户覆盖互联网头部企业、大模型厂商及各行业头部企业。
什么是Token工厂?
Token是AI大模型处理信息的基本计量单位,每一次AI对话、代码生成背后都伴随着Token的消耗。Token工厂的本质,是将算力、推理引擎和运营系统组合起来,把底层复杂性封装成企业可以直接调用的Token产品——就像用电不需要自己建发电厂一样。
开源模型越繁荣,Token工厂越值钱
DeepSeek、Kimi、GLM、MiniMax等开源模型密集发布,企业可以直接下载模型权重,通用推理框架也日趋成熟。表面上看,大模型推理正在变成"有卡就能干"的生意。
**但事实并非如此。**魔形智能创始人、CEO徐凌杰指出:"模型是开源的,但高效的部署方式并不会全部开源。"模型能够运行,只代表生产出了Token;能否在大规模并发下守住延迟、吞吐、成功率和成本,才决定这些Token能不能卖出去。
开源模型提供了共同的原料,高效部署则决定工厂之间的产量、质量和利润。模型权重越容易获得,单纯"拥有模型"的稀缺性越低,资本开始把注意力投向模型之后的生产环节——谁能把相同模型运行得更快、更稳、更便宜,谁就更有机会获得客户和利润。
商业模式如何跑通?
魔形智能披露的日均数万亿Token,是客户已经调用并产生收入的实际用量,并非理论产能。按照目前增速,公司2026年营收预计将达到数亿元。
其市场策略是先服务大B客户。大型互联网企业对稳定性和性能要求极高,供应商通常需经过多轮测试才能进入生产环境。一旦服务质量得到验证,客户会增加采购份额,并将更多模型和业务迁移到同一平台。魔形智能的Token已进入部分互联网企业的核心业务,主要用于研发团队的日常工作、AI编程及内部办公流程。
这类客户对价格敏感,但质量排在价格之前。首先要守住接口成功率——AI编程和办公集中在工作时间,接口频繁失败则工具难以进入工作流。其次是响应速度,首Token延迟超过3秒,很多企业客户已难以接受。
在部分业务场景中,算力采购和运行成本可占Token总成本的八成甚至九成。魔形智能目前已有相当比例的模型达到盈亏平衡,整体业务正在向规模化盈利靠近。
下一站:日均10万亿Token
魔形智能计划继续扩充算力资源和技术团队,迭代自研推理引擎,推进国产超节点及相关硬件研发,覆盖更多开源模型和AI算力芯片的组合。公司下一个目标,是将日均Token产量推向10万亿级。
多家战略资源方入局,意味着魔形智能获得的不只是财务资金,还包括算力、数据中心和产业资源。行业竞争焦点正从拥有多少算力,转向每元钱、每瓦电力究竟能生产多少可用Token——真正的较量,是谁能把工厂稳定地开起来,持续产出可销售的智能。




