跳到正文
非凡资本

研究与观点 / UNIQUERESEARCH

我的Token账单暴增100倍,智谱MiniMax的700倍PS凭什么?

COVER STORY

我算了一笔账:Agent时代,我的Token账单会暴增100倍,智谱MiniMax的700倍PS凭什么?




昨天晚上,我打开智谱后台一看,这个月Coding Plan已经烧掉近1.9亿Token,账单数字跳出来时,我愣了三秒。

涨价30%之前,我一个月顶多用8000万;现在呢?GLM-5一上线,复杂Agent任务一跑就是千万级,我居然还觉得"值"。

这不是我一个人在疯。2月12日智谱发涨价函当天,Coding Plan新套餐上线即售罄;MiniMax同一天放出M2.5 Agent原生模型,Highspeed极速版也瞬间被开发者抢光。

两天后,马年港股首个交易日(2月20日),恒生科技指数跌近3%,智谱却暴涨42.72%收725港元,市值冲破3232亿港元;MiniMax涨14.52%,市值同步突破3000亿港元。

700倍PS的估值摆在那儿——MiniMax 2025年前9个月营收只有5344万美元(约3.76亿人民币),按当前市值算PS超700倍,比OpenAI的65倍高出一个数量级。

市场到底在赌什么?我的Token账单一算,就明白了。

我的Token账单暴增100倍,智谱MiniMax的700倍PS凭什么? · 原文图片 1

我的账单故事:从¥200到¥1000,我觉得值

先说说我自己是怎么用智谱的。

我是从2024年10月开始用的。那时候GLM-4刚出来,我主要是为了替代GitHub Copilot——Copilot一个月10美元,智谱当时有首购优惠,一个月才几十块人民币,真香。

刚开始几个月很稳定,每天写代码、Debug、写文档,一个月8000万Token左右,成本¥200-300,我觉得挺省的。

转折点在今年1月。我开始用OpenClaw配Agent,让AI自动处理一些重复性工作——自动抓竞品信息、自动生成周报、自动回复一些标准化问题。1个Agent跑起来,Token消耗涨到了1.5亿/月,我觉得还能接受,毕竟省了我不少时间。

但GLM-5一上线,情况彻底变了。

我开始尝试更复杂的Agent任务——多Agent并行开发项目、Agent自动分析代码库重构代码、Agent自动写技术文档生成测试用例。结果账单直接爆炸:2月前20天就1.9亿Token,预计全月2.5-3亿,成本¥800-1000(涨价后)。

问题是——我居然还觉得"值"。

因为这个月我用AI完成了以前需要3个人做的工作:2个完整项目的代码重构、15篇技术文档、20份竞品监控报告、还有3个群的自动管理(日均消息200+)。如果招人来干,成本至少¥15000/月。


100倍消耗不是夸张,是保守估计

我说的"100倍",不是我一个人的故事。

看看其他开发者的真实情况。

有个后端工程师,之前手动写代码查文档,一天50万Token。现在配置了5个Agent分别负责架构设计、代码实现、测试、文档、运维,一天平均630万Token,峰值9700万Token。他的原话:"以前我写代码,现在我看Agent写代码然后Review。效率提升了,但Token消耗确实吓人。"

还有个AI创业公司的CTO,公司10个人配置了30个Agent,有的负责客服自动回复,有的负责数据分析,有的负责内容生成。公司月Token消耗15亿,成本¥5000/月。他算账:"如果招人来完成这些工作,至少需要15个人,成本¥12万/月。Agent方案省了80%。"

最夸张的是一个独立开发者,跑自动化交易Agent,7×24小时监控市场分析数据执行交易,单日Token消耗最高1.2亿,单月成本¥4000+。他的反馈:"刚开始心疼Token,后来算了一笔账——Agent帮我赚的钱,够付100年的Token账单。"

这些不是特例。普通程序员一天最多写几千行代码、读几万字文档;一个Agent 7×24小时写代码、调用工具、反思迭代、执行多轮,一天轻松1000万-几千万Token。

1000万Token是什么概念?中文里1 Token约等于1-1.5个汉字,1000万Token就是700-1000万字。相当于读完12-18本《战争与和平》,或者把《哈利·波特》读7-9遍,或者写完一本30-50万字的长篇小说再加上全部注释和迭代版本,或者一个程序员3-5年的代码量。

一个人一天最多读10万字、写1万字。一个Agent可以24小时不睡觉,把你一天的工作量乘以100。未来一个人背后跑10个、100个Agent呢?Token消耗直接指数级爆炸。

这就是为什么我说"100倍"——不是夸张,是保守估计。


智谱凭什么涨价30%还被抢空?

中金公司研报有句话说得透:行业定价逻辑正从"流量消耗"转向"算力价值变现"。

回想一下2024年上半年,大模型价格战打得头破血流——字节豆包0.0008元/千Token、阿里通义千问GPT-4级模型降价97%、智谱自己也降过90%。那时候的逻辑是抢占市场份额,亏损也要上量。

现在呢?智谱Coding Plan涨价30%,取消首购优惠,海外API翻倍,结果新套餐上线即售罄,还加周限额。MiniMax M2.5 Highspeed版100 tokens/s,连续跑1小时只要1美元,结果极速版被开发者抢光。

这不是割韭菜,是定价权真正确立的信号。

为什么这么说?因为Token正在变成"新石油"。

石油的价值不在于石油本身,而在于它能驱动汽车、飞机、工厂。Token的价值不在于Token本身,而在于它能驱动Agent完成工作。当模型能力足够强、Agent开始大规模部署时,Token的供需关系会发生根本性翻转。

供给是线性的——GPU、电力、芯片扩产要1-2年。需求是指数的——模型每强一点,就解锁10倍新场景。这就是为什么智谱敢涨价30%还被抢空——用户不是在买"软件",而是在买"持续燃烧的能源"。


开发者的"真香"现场

我收集了一些开发者的真实反馈。

有个程序员说:"Pro套餐就够我用了,但Max我还是续了,因为复杂分布式系统工程只有GLM-5能一次搞定。以前用GPT,一个月$200+,现在智谱Max一个月¥800,还能接受。"

还有个AI创业者说:"以前写throwaway code还心疼Token,现在用GLM Coding Plan随便扔,效率直接起飞。一个功能从构思到上线,从3天缩短到3小时。"

独立开发者阿杰更直接:"GLM-5对标Claude Opus 4.5,速度还更快,涨价后我都没考虑换竞品。说实话,只要质量稳定,再涨30%我也认。"

某大厂算法工程师告诉我:"我们团队从OpenAI迁移到智谱,成本降低了40%,效果差不多。现在内部新项目默认用智谱,老项目还在用OpenAI的也在慢慢切。"

这些声音不是营销,是真实的用户粘性。市场用700倍PS在投票——未来Token会像电一样,成为每个人、每家企业的基础设施级消耗品。你不会用PS给电力公司估值,你看的是负荷率、定价权、需求曲线。


但我必须把风险说锋利一点

这个逻辑是对的,但"时间窗口"才是真正的赌注。

MiniMax招股书显示,前9个月收入增长170%,净亏损却高达5.12亿美元——卖1块钱亏10块。虽然亏损在收窄,但距离盈亏平衡还很远。

MiniMax超过70%收入来自海外,核心产品Talkie用户粘性还没被长期验证。智谱的Coding Plan虽然火,但编程助手市场的天花板有多高?当Claude、Gemini、GPT都在同一个赛道上时,定价权能维持多久?

还有一个容易被忽略的因素——这波暴涨发生在港股,而港股AI纯正标的极度稀缺,就智谱、MiniMax、海致科技三家。当大量资金涌入一个极窄的赛道时,估值溢价会被急剧放大,这不完全是基本面驱动的,也有资金结构的因素。

700倍PS赌的是"Agent时代明年就全面爆发"。如果慢了3-5年,今天的定价就可能站不住脚。

但有一点已经不可逆——当涨价30%还售罄、开发者宁可多掏钱也要用的时候,供需关系已经彻底翻转。Token经济学黎明已至,问题只是黎明会持续多久,太阳什么时候真正升起。


我做完这笔账后的三个动作

第一,把年付Coding Plan续了,锁住相对低价。

第二,开始研究怎么把简单任务切到更便宜的开源/分层模型,留顶级Agent给智谱和MiniMax。具体策略是——简单任务(信息抓取、格式转换)用MiniMax M2.5 Highspeed版或本地模型;中等任务(代码生成、文档撰写)用GLM-5 Pro版;复杂任务(架构设计、复杂推理)用GLM-5 Max版或Claude Opus。

第三,重新评估我的Agent配置。不是每个任务都需要顶级模型——监控类Agent用便宜模型7×24小时跑;创作类Agent用顶级模型但需要时调用;交互类Agent用中等模型平衡成本和质量。


我们都才刚刚开始学会"用电"

2000年中国移动用户8000万时,谁能想到移动互联网会重写一切?今天Token也站在类似拐点。

你的Token账单这个月涨了多少?未来准备怎么应对100倍的"电费"?

欢迎在评论区分享你的真实用量和策略。我们一起见证——也一起准备好——这个Token变成新时代"电"的历史时刻。


数据来源:真实使用经验 + 开发者群调研 + 公开财报

声明:投资有风险,本文不构成投资建议

来源:非凡产研 · 腾讯新闻。文章中的“非凡产研”是原始发布账号署名,不代表已核实个人执笔作者。引用访谈或圆桌观点时,应按正文标明具体发言人及当时身份;无法确认时不要推断。日期为原始发表日期,历史信息以发布时点为准。

阅读原始发布版本 ↗
← 返回研究文章库