Max plan 到底有多划算
订阅制与按量计费的天壤之别
说实话,切到 API 计费之前,我对 claude code 一个 session 到底烧多少钱没什么概念。切过去以后,才第一次看到真实的数字。一台笔记本,14 天,按 API 价格折算烧掉了几千美元的算力。云端那台 devbox 也在跑,20 天又是几千。可 Max plan 收的是固定月费。折算下来,我一个月用掉的算力按 API 价格算是月费的几十倍,差了 40 到 50 倍。不知道 Anthropic 是怎么想的,我只能说这个定价挺离谱的。上一篇说 benchmark 是假指标,这篇来算一笔真账,把 claude code 当主力工具,到底要烧多少钱。
账是这么算的。有个开源工具叫 ccusage,做得挺好,它会读 claude code 存在本地的 session 日志,按 Anthropic 公开的 API 定价,把用掉的 token 折算成钱。我想知道的就一件事,如果没有 Max plan,全按量付费,我这些用量到底要付多少钱?
用 ccusage 跑了 2 月 19 日到 3 月 4 日的明细。haiku、opus、sonnet 所有模型加起来,这 14 天一共用了 74.8 亿 token,按 API 价格算是几千美元,而月费是固定的。其中有两天特别夸张,一天的量按 API 价格算就是月费的 6 到 8 倍。
钱的大头花在 opus 4.6 上。它是 claude 系列最贵的模型,按 token 算非常贵。在 Max plan 下,claude code 会自动分配模型,复杂任务给 opus,简单任务给 sonnet 或者 haiku,什么都不用配,该用最好的时候永远用的是最好的。换成 API 计费就不一样了。cc 每次想起一个 research agent,或者做一轮深度分析,opus 的 output token 就按最高那档的单价往上跳,你的理性反应一定是逼所有任务都用 sonnet,不是非用不可就不上 opus。这样你就开始在工具和成本之间做取舍,注意力从问题本身挪到了省钱上。
2 月 27 日和 3 月 2 日开发强度很高,这两天 cache read 的数字挺吓人,一天 34 亿 token,一天 24 亿。为什么这么大?因为每个 agent 都在把大段的代码库读进 context。agentic coding 用到这个规模,真实情况就是这样。编排系统同时开好几个 AI 线程,每个线程吃掉的 context 和代码库大小成正比,钱是按指数级的速度在烧。这跟打一句 prompt、等一个回复,完全是两种用法。
上面这些还只是一台笔记本的数。另一台云端 devbox 也在跑 claude code,主要跑后端那边重度用 opus 的 session,活跃日有 20 个左右,保守估计按 API 价格又是几千美元。两台机器加起来,一个月用掉的算力按 API 价格算就是月费的几十倍,40 到 50 倍。回本用不了一天,每个月认真用的第一天,烧掉的算力就已经超过月费了。哪怕你每天只是在真实的代码库上用 claude code 超过 2 小时,第一周烧掉的也已经比月费多了。
把固定月费和按 API 计价的等价成本并排比,差 40-50 倍,第一天就回本。
比账单更有意思的是心理上的变化。按 API 计费的时候,你脑子里一直有个计价器在转。跑一个 agent 是 opus token,多做一轮调研又是 opus token,让 cc 同时试三种方案就是三倍 token。理性的做法是省着用,用便宜的模型,跳过额外的调研,少开并行 agent。但这么一省,产出的质量直接就掉下去了。agentic coding 最值钱的地方,就是让 AI 替你大范围地探索、多试几种方案、拿算力换时间。你去限制算力,就等于把这个好处也限制住了。
按量计费时脑中的计价器逼你省着用、压低产出质量;Max 关掉计价器,AI 全功率跑。
用 Max plan,这层心理负担就直接没了。你不用想现在跑的是哪个模型,也不用犹豫要不要并行,AI 全功率跑,后面没有钱的压力在拖着它。这在任何 token 统计里都看不出来,但产出的质量确实更好。
这笔账算下来,Max plan 适合三类人:
- 把 AI 当主力工具的独立开发者和小团队。不是偶尔让它补个函数,是把它当主要的工程搭档,跑 agentic workflow、开并行 agent、塞很深的 context。这么用的话,每个月按 API 价格算的消耗远远超过月费。
- 会因为成本给自己设限的人。如果你脑子里冒出过「这个任务 sonnet 就行了,省点钱」,而这个任务其实 opus 能做得更好,那 Max plan 能让你从此不用再纠结这个。
- 一个月用量超过 10 亿 token 的人。到这个量,API 成本远远超过 Max 的月费。两边打平大概是在一个月 5 亿 token,认真跑 agentic coding 的话,第一周就能用过这个数。
反过来,如果你用得很轻,每天就几个 prompt,不跑 agent,任务基本用 sonnet 就能搞定,那 Pro plan 就够了。Max 是给把 AI 算力当吃饭家伙的人准备的。
还有一笔账我也算过。Anthropic 在我这个订阅上不可能赚钱,大概率在亏,而且亏得不少。光我一个用户,用量就是付费的几十倍,把所有 Max 重度用户加起来,这个经济模型显然撑不住。差 40 到 50 倍,只能说是抢市场的价格,不是市场稳定下来以后的价格。Anthropic 等于是拿真金白银补贴算力,买市场份额,把开发者养起来。等这批人把整个工作流都建在 claude code 上,肌肉记忆、开发流程、团队的工具链全都深深绑在上面,再想换就难了。所以这个窗口估计不会一直开着,到了某个时候,Max 要么涨价,要么加用量限制,要么分档定价。
补贴期用低价养住开发者、绑定工作流,切换成本越来越高,窗口迟早关闭涨价。
我自己就是趁补贴还在,能多用就多用。盘盘猫 29 天做了 10 个 app。Mio v1 那次是从一个空仓库开始,4 天做出一个能语音陪聊的伴侣。现在的 Mio v2 整个产品方向都转了,设计和实现也是在完全不用想成本的时候做完的。这些项目要是按 API 价格付钱,没有一个算得过账。能全做出来,靠的就是固定月费换来的几十倍算力。之前写过软件正在变成一次性的,还有agent 经济正在形成那篇,说的其实是同一个变化,老牌玩家感觉还没搞清楚发生了什么。现在动手的人,是在有人补贴的基础设施上 ship 产品。等窗口关上(我瞎猜也就六个月),竞争对手就得按全价买同样的能力。

