2567 字
13 分钟
`claude -p` 的二十块钱:一份被社区 Community Note 的「免费赠品」

5 月 14 日晚上 8 点 10 分太平洋时间,Anthropic 给 Max 20x 订阅用户发了封邮件:6 月 15 日起,claude -p、Agent SDK、GitHub Actions、以及通过订阅认证的第三方工具,将从订阅用量池中分离出来,转入一个独立的月度信用额度。

Anthropic 把这个叫做”免费赠品”。

开发者关系负责人 Lydia Hallie 在 X 上发了公告。几小时内被 Community Note 了。社区对公司叙事的 peer correction,实时发生在官方帖子下面。

这份”赠品”的面值 计划 20/,Max5x20/月,Max 5x 100/月,Max 20x 200/月。按API标准价格计量,没有rollover200/月。按 API 标准价格计量,没有 rollover。20 的 Opus API token 大约够跑一到两次像样的 headless agent session。之前呢?同一个 20Pro订阅,通过claudep或者第三方工具,能榨出大约[20 的 Pro 订阅,通过 `claude -p` 或者第三方工具,能榨出大约 [236 的 API 等价计算量](https://gist.github.com/MagnaCapax/d9177e35b355853f03c730dfcaa693ef)——The Register 四月份引用了 OpenClaw 的案例。Boris Cherny,Claude Code 负责人,说了一句很诚实的话:“our subscriptions weren’t built for the usage patterns of these third-party tools。”

他说的是事实。但”免费赠品”这个包装不对。把 236的隐性补贴砍到236 的隐性补贴砍到 20,叫什么都行,就是不叫赠品。

你不是用户,你是标注员#

表面上看,Anthropic 想做的事情很简单:程序化使用太便宜了,要涨价。但如果只是嫌程序化用户占便宜,直接降周限额就行了。订阅已经有 5 小时滚动窗口和周限额,claude -p 撞的是同一面墙。为什么非要拆成两个池子?

因为 Anthropic 不想碰交互池。交互用户有一种程序化用户没有的价值:他们是免费的 RLHF 标注员。

每一次 thumbs up、每一次 thumbs down、每一次重新生成,都是人类偏好信号。Anthropic 的隐私政策写得明白:通过 thumbs up/down 提交的反馈,连同相关的完整对话,保留 5 年,可以用于分析服务效果、研究用户行为、训练 AI 模型。从 2025 年 8 月起,选择了”帮助改善 Claude”的消费者用户,对话以去标识化形式保留最长 5 年,可用于模型训练。

Anthropic 的研究团队也在身体力行。2026 年 4 月发布的一份报告里,他们对 100 万条 claude.ai 对话做了采样,研究用户如何向 Claude 寻求个人建议,方法的关键一步:用”通过 Feedback 按钮分享给 Anthropic 的真实对话”来做 stress-test,找出之前模型表现谄媚的场景,测试新模型能不能纠正。用户按了 thumbs down 的对话,变成了下一代模型的训练素材。

这就是交互用户 20订阅费的真实成本结构。Anthropic付出了算力,换回了两样东西:订阅收入和训练数据。如果一个交互用户每个月贡献了几十次thumbsup/down和几百条对话,这些偏好信号的长期价值远超20 订阅费的真实成本结构。Anthropic 付出了算力,换回了两样东西:订阅收入和训练数据。如果一个交互用户每个月贡献了几十次 thumbs up/down 和几百条对话,这些偏好信号的长期价值远超 20。Anthropic 有充足的经济理由对交互用户慷慨。

claude -p 呢?一个 cron job 不会按 thumbs up。一个 CI pipeline 不会重新生成答案然后挑一个更好的。一个 shell 脚本调 claude -p --print,拿到输出就走,什么反馈都不留。从 Anthropic 的视角看,这些用户是纯成本:消耗算力,不生产训练信号。写请求的第一方是代码,不是人。

所以拆池子的真实逻辑不是”防止滥用”——5 小时窗口加周限额已经在防了。是:交互用户在用算力付钱的同时也在用反馈付钱,程序化用户只在用算力付钱。两类用户的单位成本不一样,放在同一个池子里定价做不到价格歧视,必须拆开。

左脑攻击右脑#

这个逻辑自洽,直到你看 Anthropic 的产品路线图。

Anthropic 自己 6 月 16 日发布的 400K session 分析里有一组数据:在 Claude Code 的交互 session 中,用户做了大约 70% 的 planning 决策(做什么),Claude 做了大约 80% 的 execution 决策(怎么做)。更有意思的是趋势——他们之前的自主性报告显示,随着用户变得更熟练,auto-approve 的使用率从新用户的 20% 上升到老用户的 40% 以上。99.9 百分位的 turn duration 在 2025 年 10 月到 2026 年 1 月之间几乎翻倍,从不到 25 分钟增长到超过 45 分钟。

换句话说:用户越熟练,越倾向于让 Claude 自己跑,越少打断,越少提供 human feedback。产品团队的 KPI 大概就是这些指标——自主性更高,session 价值更大,用户从执行者变成 supervisor。这是 Anthropic 积极推销的叙事:“domain expertise matters more than coding background”,用户只需要说做什么,Claude 来决定怎么做。

同时,定价团队画了一条线:有 human 在 loop 里的,走订阅;没有 human 在 loop 里的,走 API 价格。

产品团队在拼命把 human 从 loop 里踢出去。定价团队在拼命按 human 在不在 loop 里收费。左脑攻击右脑,右脑攻击左脑。

这不是比喻。看一下 Anthropic 最近推的功能。Claude Code 可以 spawn 子 agent,子 agent 可以自主运行,自己读文件,自己跑命令,自己决策。一个”交互 session”里,用户打了一条指令,Claude 可以在后台启动五个 subagent 并行工作。这五个 subagent 的 token 消耗算交互还是算程序化?按 Anthropic 的分类,它们在一个交互 session 里启动的,所以算交互。但它们运行的时候没有任何 human in the loop。它们不会被 thumbs up。

Fable 5 也是。Anthropic 6 月 9 日发布 Fable 5 的时候,卖点之一就是 agentic capabilities——更长的自主运行、更复杂的工具调用、更少的人类干预。Gizmodo 的报道里提到,Fable 5 发布后用户立刻开始抱怨 usage window 消耗速度明显加快。模型越 agentic,每条指令触发的 token 越多,交互和程序化之间的边界越模糊。

dynamic workflow 更彻底。hooks、conductor/subagent 模式、自动化测试循环——这些 Anthropic 官方文档和社区都在积极推广的 pattern,核心思路就是让 Claude 自己编排多步任务。用户给一个高层指令,后面的十个步骤 Claude 自己走。你在终端里打了一行字,这算交互;这行字触发的后续 200 次 API call,本质上就是 claude -p

区别是什么?一个 -p flag。

33 天#

5 月 14 日宣布。6 月 15 日原定生效。中间发生了这些事:

Zed 和多个第三方工具开发者公开反对。这些工具通过订阅认证让用户在 Zed 编辑器或其他第三方界面里使用 Claude。Agent SDK 信用额度一旦生效,它们的用户会在几天内烧光 $20 的信用额度,然后要么停摆,要么开始按 API 价格计费。Anthropic 四月份就限制过第三方工具的订阅访问,24 小时内撤回,当时 Boris Cherny 说的也是 subscriptions weren’t built for this。

5 月 14 日同一天,Sam Altman 给新 OpenAI 商业客户提供了两个月免费 Codex。时间点很巧。

6 月 9 日,Anthropic 发布 Fable 5 和 Mythos 5。三天后美国政府出口管制令下来,两个模型全球下架

6 月 14 日,华盛顿特区用户 Karl Kahn 在加州北区联邦法院提起集体诉讼。诉状的核心指控:$200/月的 Max 20x 实际只提供了 Pro 的 6 到 8 倍使用量,而非宣传的 20 倍;Max 5x 大约 3.5 倍,也没到 5。The Decoder 和多家媒体把 Anthropic 的窘境放在更大的背景里 申请正在进行中,AI 提供商之间的价格战正在加剧。在冲 IPO 的档口推一个让最活跃付费用户愤怒的定价变更,对增长叙事没有好处。

6 月 15 日,原定生效当天,Anthropic 更新了 Help Center 页面:

“The previously announced monthly credit isn’t available. We’re working to update the plan to better support how users build with Claude subscriptions.”

翻译:撤了。

杯子和水的续集#

五月份 Anthropic 宣布 5 小时限额翻倍的时候,我写过:杯子更大了,水没变多。周限额没动。

这次 Agent SDK 信用额度的故事,结构反过来了。Anthropic 想把水分到两个杯子里——一个给你手打的 prompt,一个给你脚本发的 prompt。第二个杯子特别小。理由是脚本喝水太快。

但理由的另一半他们没说:手打 prompt 的人在帮 Anthropic 标数据,脚本发 prompt 的人没有。交互用户每次按 thumbs down 都在为下一代模型提供免费的偏好标注。claude -p 只消耗,不生产。从成本结构上看,交互用户是双向交易——算力换订阅费加训练数据;程序化用户是单向消耗——算力只换到了订阅费。Anthropic 有充分的经济理由补贴前者、限制后者。

问题在于,Anthropic 自己的产品正在让这条线消失。subagent、dynamic workflow、auto-approve、越来越长的自主运行时间——每一个 feature 都在减少交互 session 中 human 实际在 loop 里的比例。Anthropic 的 400K session 研究说用户做 70% 的 planning,Claude 做 80% 的 execution。但 planning 只发生在 session 开头的一两条消息里,execution 可以跑几十分钟不停。按 token 算,一个”交互 session”的绝大多数 token 是 Claude 在没有 human oversight 的情况下消耗的。

这些 session 贡献训练信号吗?也许 session 结束后用户按一次 thumbs up。但 session 中间那些 subagent 的工作、那些自动化工具调用、那些 Claude 自己决定读哪些文件和跑哪些命令的步骤——这些步骤没有逐条的人类反馈,跟 claude -p 在信号密度上没有本质区别。

Anthropic 迟早会回来处理这个问题。20的订阅跑出20 的订阅跑出 236 的算力,这是真实的结构性亏损。但下一次他们需要找到一条比”有没有 -p flag”更好的线。因为他们自己的产品,正在让这条线变得毫无意义。

`claude -p` 的二十块钱:一份被社区 Community Note 的「免费赠品」
https://blog.lishuyu.app/posts/2026-06-25-claude-p-agent-sdk-credit-pause/
作者
猫猫魔女
发布于
2026-06-25
许可协议
CC BY-NC-SA 4.0