MiniMax|ARR超8亿美元:B端占比约八成,Token消耗约增至20倍

PromptTree|阅读 0
2026/08/28 12:16
MiniMaxARR开放平台Agent
MiniMax披露ARR超8亿美元、B端收入占比抬升,上半年开放平台收入同比大增;M3定价与H3开源被指拉动API调用,电话会强调Minimize Inference Cost。

模型公司最怕两件事叠在一起:一边烧算力训练,一边C端订阅撑不起账单。MiniMax用电话会与半年报口径给出另一条曲线——年度经常性收入(ARR)从今年2月约1.5亿美元抬到8月超过8亿美元,大约5.3倍;同期Token消耗量到7月已达1月约20倍。对采购方而言,这更像在问:Agent工作流是不是终于把「聊天级用量」换成了「产线级用量」。

MiniMax是国产大模型与多模态公司,2021年底成立,产品覆盖开放平台API、企业服务,以及Talkie、海螺AI等消费级应用。Talkie与海螺在海外市场曾带来可观下载与订阅,但大模型行业近年的主战场已明显转向「谁能把API与Agent账单跑稳」。公司2026年上半年收入约1.166亿美元,同比增长约283.1%,已超过2025年全年约7904万美元;第二季度收入较一季度环比增长约81.8%。结构变化比总量更醒目:上半年开放平台及其他AI企业服务收入约7393万美元,同比增约703.1%,占总收入约63.4%;到8月,从ARR结构看,To B与To C约呈八二开,而2025年全年B端占比大约仅三成。

财务与效率可核对要点:

  1. 毛利与费用:上半年毛利约2081万美元,毛利率由约12.1%升至约17.9%,公司归因于基础设施效率;销售及分销开支同比约降17.9%,指向自然增长减少买量依赖。
  2. 研发:上半年研发开支约2.969亿美元,同比增约138.8%,增速低于收入增速——训练仍在投,但商业化开始「跑在前面」。
  3. 客户与用量:企业客户与开发者到5月突破约200万,约为去年底的10倍;M3模型发布后老客户扩量,视频生成模型H3开源后三周内公开称超约2400万次下载、300多个衍生模型,被指反哺官方API付费调用。
  4. 定价:M3每百万Token约1.2美元,低于公司所称同级中位数约2.2美元;对外口号概括为「Minimize the Inference Cost, Maximize the Intelligence」。

所谓ARR,白话是把当前经常性收入年化后的「跑速表」,不等于已审计的全年利润表收入;所谓Token暴增,白话是调用从「人问一句」切到「Agent连跑几十步」——同一个人、同一个开发者账号,背后可能是十倍、二十倍的推理次数。MiniMax CEO闫俊杰在电话会中把7月Token消耗与1月对比到约20倍,并把2月ARR约1.5亿美元与8月超8亿美元并置,三者同向抬升,说明模型正进入企业和开发者的真实工作负载,而不只是Demo调用。

Agent红利如何体现在账单上?

公开叙事里,Agent工作流与聊天机器人消耗不在一个量级:聊天是「一问一答」,Agent是「规划—调工具—再规划—再调工具」,每一步都要回模型推理。H3开源带来的社区下载与衍生模型,相当于免费做了开发者教育——熟悉技术栈后,需要云端稳定服务时转向API,这是典型的「开源引流、API变现」路径。C端并未萎缩:上半年AI原生产品收入约4264万美元,同比约翻倍,说明Talkie、海螺仍在增长,只是B端跑得更快。

产业观察上,MiniMax叙事正从「有C端爆款」转向「开放平台吃Agent红利」。可以把它想成:模型是发动机,推理成本是油耗,Agent是把油门踩到底的司机。对投资人,要对照毛利率能否随用量同步改善、大客户集中度,以及自建集群ETTR(有效训练时间比例,白话是「GPU有多少时间在真正训练而不是空转」)是否可第三方复现。对CIO,验收项应是同一工单在M3上的失败重试成本、长上下文稳定性,而不是只看电话会里的ARR曲线。

需要把边界读清楚。电话会口径与半年报数字以公司正式披露为准;ARR与Token倍数易随统计口径波动;与DeepSeek、千问等低价API的竞争仍在加剧。下一观察点是B端续约率、H3开源后的付费转化率,以及推理单价在价格战下能否守住。