Max plan 到底有多划算
订阅制与按量计费的天壤之别
说实话,切到 API 计费之前,我对 claude code 一个 session 到底烧多少钱是没什么概念的。切过去之后才第一次看到真实数字:一台笔记本,14 天,烧掉几千美元的 API 等价算力;云端那台 devbox 也在跑,20 天又是几千。而 Max plan 收的是固定月费。折算下来,我一个月用掉的算力按 API 价格算是月费的几十倍,差价 40 到 50 倍。不知道 Anthropic 是怎么想的,但我只能说,这个定价挺离谱的。上一篇说 benchmark 是假指标,这篇算的是真账:把 claude code 当主力工具到底烧多少钱。
账是这么算的。有个开源工具叫 ccusage,做得挺好的,它读 claude code 本地的 session 日志,把 token 消耗按 Anthropic 公开的 API 定价折算成等价成本。要回答的问题就一个:如果没有 Max plan,全按量付费,我这些用量实际要付多少钱?
ccusage 跑了 2 月 19 日到 3 月 4 日的明细。haiku、opus、sonnet 所有模型加起来,20 个活跃日,总共消耗 74.8 亿 token,API 等价成本几千美元,而月费是固定的。其中两个峰值日特别夸张,单日的 API 等价成本就是月费的 6 到 8 倍。也就是说,一天烧掉的算力,比一个月的订阅费还多好几倍。
这些钱的大头花在 opus 4.6 上,claude 系列最贵的模型,按 token 计价非常贵。Max plan 下 claude code 是自动路由的:复杂任务给 opus,简单任务给 sonnet 或者 haiku,不需要任何配置,该用最好的时候永远用最好的。换成 API 计费就不是这样了:每次 cc 想启动一个 research agent,或者做一轮深度分析,opus 的 output token 就按最高档单价往上跳,理性的反应一定是强制所有任务用 sonnet,非必要不上 opus。你就开始在工具和成本之间做取舍了,注意力从问题本身挪开,挪到省钱上去了。
2 月 27 日和 3 月 2 日是两个高强度开发日,cache read 的数字挺吓人的,一个 34 亿 token,一个 24 亿。为什么会这么大?因为每个 agent 都在把大段代码库读进 context。这就是 agentic coding 规模化之后的真实样子:编排系统同时开好几个 AI 线程,每个线程的 context 消耗跟代码库规模成正比,烧钱的速度是指数级的。这跟打一句 prompt 等一个回复,完全是两种用法。
上面这些还只是一台笔记本的数据。另一台云端 devbox 也在跑 claude code,主要是后端的 opus 重度 session,也是 20 个左右的活跃日,保守估计又是几千美元的 API 等价成本。两台机器加起来,一个月的 API 等价算力就是月费的几十倍,40 到 50 倍。回本天数不到一天——每个月认真用的第一天,烧掉的算力就已经超过月费了。哪怕你只是每天在真实代码库上用 claude code 超过 2 小时,第一周烧掉的也已经超过月费。
把固定月费和按 API 计价的等价成本并排比,差 40-50 倍,第一天就回本。
比账单更有意思的是心理这层。API 计费下,脑子里一直有个计价器在转:跑一个 agent 是 opus token,多做一轮调研又是 opus token,让 cc 同时试三种方案就是三倍 token。理性的行为是省着用,用便宜的模型,跳过额外的调研,少开并行 agent。但这个「省」直接把产出质量压下去了。agentic coding 的核心价值,就是让 AI 替你广泛探索、多试几种方案、拿算力换时间;你去限制算力,就是在限制这个价值本身。
按量计费时脑中的计价器逼你省着用、压低产出质量;Max 关掉计价器,AI 全功率跑。
Max plan 下这层心理负担直接就没了。不用想现在跑的是哪个模型,不用犹豫要不要并行,AI 全功率跑,后面没有经济压力在节流。这件事不会出现在任何 token 统计里,但产出的质量确实是更好的。
这笔账算下来,Max plan 适合三类人:
- 把 AI 当主力工具的独立开发者和小团队。不是偶尔让它补个函数,是把它当核心工程伙伴,跑 agentic workflow、并行 agent、深度 context,这种用法每个月的 API 等价消耗远超月费。
- 会因为成本自我设限的人。如果你发现自己脑子里冒出过「这个任务 sonnet 就行了,省点钱」——其实 opus 能做得更好——Max plan 把这个问题永久性解决了。
- 月用量超过 10 亿 token 的人,这个量级下 API 成本远超 Max 月费。交叉点大概在月用量 5 亿 token,认真跑 agentic coding 的话,第一周就能突破。
反过来,轻度使用,每天几个 prompt,不跑 agent,任务基本停在 sonnet 级别,那 Pro plan 就够了。Max 是给把 AI 算力当核心生产资料的人准备的。
还有一层账我也算过。Anthropic 在我这个订阅上不可能赚钱,大概率在亏,而且亏得不少——光我一个用户,用量就是付费的几十倍,所有 Max 重度用户加起来,这个经济模型显然撑不住。40 到 50 倍的差价,只能说是抢市场的价格,不是均衡价格,等于是在拿真金白银补贴算力,买市场份额,养开发者群体。等这批人把整个工作流建在 claude code 上,肌肉记忆、开发流程、团队工具链全深度绑定了,切换成本就大了。所以这个窗口估计不会永远开着,到某个时间点,Max 要么涨价,要么加用量限制,要么分层定价。
补贴期用低价养住开发者、绑定工作流,切换成本越来越高,窗口迟早关闭涨价。
我自己就是趁补贴还在,能多用就多用。盘盘猫 29 天做了 10 个 app。Mio v1 那次是从空仓库开始,4 天做到一个能语音陪聊的伴侣。现在的 Mio v2 整个产品方向转型,设计和实现也是在完全不用想成本的状态下做完的。这些项目要是按 API 定价,没有一个在经济上算得过来;能全部做出来,靠的就是固定月费给的几十倍算力杠杆。之前写过软件正在变成一次性的,还有agent 经济正在形成那篇,说的其实是同一个变化,老牌玩家感觉还没搞清楚发生了什么。现在动手的人,是在被补贴的基础设施上 ship 产品;等窗口关上——我瞎猜也就六个月——竞争对手就得按全价买同样的能力。

