AI 的成本从来不是单价决定的,是「什么算一次计费」决定的。 2026 年 9 月 24 日,Anthropic 宣布对被安全分类器在输出之前拦下的请求恢复计费。模型一个字都没输出,这笔钱照收。
对架构师来说,这不是一条涨价新闻。它意味着我们一直用来估算成本的那个公式,有一项的价格从零变成了正数,而我们没有改过一行代码。
变化本身:范围只有三类,但方向很清楚
先说事实。Anthropic 官方账号 @claudedevs 在 9 月 24 日发布公告,Anthropic 员工 Edwin Arbus 在同日补充说明:从当天起,Claude 在给出回复前被安全分类器中断的请求恢复计费。
| 维度 | 内容 |
|---|---|
| 生效时间 | 2026-09-24(公告称「今天」,未给出具体时刻) |
| 计费范围 | 仅三类:生物学(bio)、蒸馏攻击(reasoning extraction)、前沿大模型开发(frontier_llm) |
| 不计费 | 其余类别、以及未命中类别的请求,输出前被拒仍不收费 |
| 适用产品 | Claude Code、Claude.ai、Cowork |
| 适用模型 | 搭载安全分类器的 Fable 5.1 / Fable 5 / Opus 5.5 / Opus 5 |
| 官方数字 | 分类器误报率调校至 <0.1%;近期测试中 99.7% 的账号未触发可计费拦截(厂商自报,未独立复现) |
| 误拦申诉 | Claude Code 内 /feedback;官方未说明误拦费用如何退还或冲正 |
| 动机 | 官方称近几周观察到针对其系统的协同攻击,让护栏探测不再免费 |
这里有个历史沿革值得知道。这套安全分类器是 2026 年 6 月 Claude Fable 5 上线时设立的,当时 Anthropic 自己承认为了优先保证安全且快速发布,误检率偏高;正因为误检多,才立下一条规矩:凡是被分类器判定危险、在输出前中断的,一律不计费。这次是把这条规矩部分打破了,理由是那三个类别的误检率已经压到 0.1% 以下。
为什么这是分母问题,不是单价问题
我做过二十年架构,算成本一直用一个笨公式:
总成本 ≈ 单价 × 输出量 × 重试次数
这个公式我讲过不止一次,因为它能挡住大多数自欺欺人——只看单价一定算错。
但在这个公式里,「被拒绝」这一项过去是零成本的:请求没走完,没有输出,自然不产生费用。很多团队的预算护栏、红队探测、评测跑批、攻击面试探,都悄悄建立在这条假设上——反正被拦下来不花钱,多试几次没关系。
现在它有了价格。
供应商改的不是价格,是分母。而分母是在你没有改一行代码的情况下变的。
同一周里还有两件事,方向完全相反:
| 主体 | 动作 | 对成本口径的影响 |
|---|---|---|
| Anthropic | 对被拦下的三类请求恢复计费 | 分母向外扩:失败与拒绝也计价 |
| 阿里(云栖 09-22) | 真武 V900 原生 FP8/FP4,官方称「精度每降一档,一度电换来的 Token 基本翻倍」 | 分母向硬件沉:从每 token 到每度电 |
| 微软(09-25) | Copilot 增加成本管理工具,让员工直接看到自己 AI 使用产生的费用 | 口径透明化:把账单摊到消费端 |
三件事不是巧合。当所有人都开始讲「每任务成本」,争的就不再是单价,而是**「什么算一次计费」的定义权**。
这件事我在虚拟电厂相关的项目里见过一模一样的版本。多方协同的系统里,真正难谈的从来不是电价,是结算口径:调峰响应算不算、响应时间从哪一秒起算、指令下发了但没执行算不算。口径改一次,所有人的账本重写一遍。AI 正在走到同一个位置上。
两个数字不是一回事,而冲正路径是缺的
官方给的两个数字很容易被混着读,值得单独拆开:
- 99.7% 的账号没触发过,说的是面(多少人受影响);
- 误报率低于 0.1%,说的是率(分类器期望误判水平)。
这两个数字谁都不能保证某一次具体拦截是对的。前者不排除你是那 0.3%,后者不排除你碰上的那次就是误判。而公告里没有写:如果拦截是错的,这笔钱怎么办。
一个计费规则改了却不给冲正路径,这不是定价问题,是争议处理机制的缺位。
对企业架构来说,这比多付的那几分钱重要得多。它意味着你在做成本归因时,无法把厂商账单当作不可争议的事实来源——你需要保留自己的调用日志作为对账依据,而且日志里必须记录「被拒绝」及其类别。
顺带一个静默失效:档位也会消失
同一周还有一条容易被忽略的变更。openai/codex 在 9 月 25 日发布的 rust-v0.157.0 里,有一条提交是 “Remove the ultrafast service tier from gpt-5.6-sol”——某个服务档位被删掉了,没有公告,没有迁移提示(同一个版本里倒是为 GPT-6 Sol / Luna 加了旧模型迁移提示)。
你依赖的东西消失的时候,你不一定会收到任何通知。
这跟计费口径是同一个问题的两面:我们把模型与档位当成稳定的基础设施,但它们实际上是随时会被重新定义的产品 SKU。既然如此,就只能自己建立核对机制。
可以立刻做的四件事
- 成本看板加一列:把「被拒绝 / 被拦截的调用数」单独统计,与成功调用分开,配独立告警阈值。理由不是它现在很贵,而是它涨的时候你目前看不到。
- 给重试加闸:同一请求被同一类策略拒绝两次即停,第三次转人工确认。以前重试是免费的谨慎,现在是带价的赌注。
- 建一张依赖清单并定期核对:把在用的模型名、档位名、service tier 列成表,逐个去官方目录核对是否还存在,标注核对日期,三个月复查一次。
- 保留独立对账日志:调用日志要记录被拒绝事件及其类别,与厂商账单分开存储,作为争议时的依据。
数据说明
- 本文 Anthropic 计费政策部分依据 Anthropic 官方账号 @claudedevs(2026-09-24)公告与 Edwin Arbus(@edwinarbus)同日说明;误报率 <0.1% 与 99.7% 账号未触发两项均为厂商自报,未独立复现,且两者含义不同,不可互相印证。
- 中文来源对第三类计费范围的译法存在分歧(「蒸馏攻击」与「reasoning_extraction」),本文以官方英文三类表述为准。
- 微软部分依据路透社 2026-09-25 报道(含 Copilot 产品负责人 Annie Pearl 受访);阿里部分依据 2026 云栖大会现场报道(科创板日报、浙江日报潮新闻、环球网,均 09-22)。真武 V900 相关性能数据为厂商自报。
- Codex 档位移除依据
openai/codex仓库rust-v0.157.0发布说明中的提交 #47130。 - 相关阅读:AI 最贵的那笔账,是它在等。
