上周帮朋友看了一下 API 账单。
他三周前刚把项目从 Claude Sonnet 4.6 换到 Sonnet 5。迁移的时候没觉得有什么问题,Anthropic 当时给出的说法也是整体成本大致持平。
7 月账单确实没怎么涨。
但他问我:“那9月呢?”
我把价格和 Token 数量一起算了一遍,发现事情没那么简单。
50%的涨价,只是第一层
Sonnet 5 目前的推广价格是:
输入 $2 / 百万 Token 输出 $10 / 百万 Token
但这个价格只到 8 月 31 日。
9 月 1 日开始恢复标准价格:
输入 $3 / 百万 Token 输出 $15 / 百万 Token
也就是说,单价直接上涨 50%。
这个价格变化其实不算隐藏得很深,Anthropic 的定价说明里写得很清楚。
真正容易被忽略的是:Token 数量也变了。
同样的内容,Token更多了
Sonnet 5 使用了新的分词方案。
简单理解就是:同样一段文字,可能会被拆成更多 Token。
Artificial Analysis 的测试显示,部分场景下 Sonnet 5 的 Token 数量比 Sonnet 4.6 高约 30%,代码、结构化数据和非英文内容受到的影响更明显。
这对普通用户可能没什么感觉。
但如果你的项目每天跑几十万甚至几百万 Token,30% 就不是小数字了。
举个简单的例子。
原来一个项目每月花 $1000。
如果换到 Sonnet 5 后 Token 增加 30%,成本先变成:
$1000 → $1300
推广期因为单价比较低,看起来问题不大。
但到了 9 月,单价再上涨 50%。
$1300 × 1.5 ≈ $1950
也就是说,原来 $1000 的业务,理论上可能接近 $1950。
所以标题里的“实际涨95%”,说的不是官方单价,而是单价上涨和 Token 增长叠加后的结果。
当然,实际账单还会受到输入输出比例、缓存命中率等因素影响,并不是所有项目都会准确涨95%。
但这件事至少提醒了我:
迁移模型不能只看单价。
真正该看的,是最终每次请求到底消耗多少 Token。
迁移之前,最好做这几件事
第一,把生产环境的 Prompt 跑一遍 Token Counting,看看 Sonnet 5 和旧模型到底差多少。
第二,检查缓存命中率。如果大量请求有重复上下文,缓存策略对最终成本影响很大。
第三,不要所有任务都用 Sonnet 5。简单分类、改写、短文本任务,可以考虑便宜一些的模型,复杂任务再交给 Sonnet。
另外,现在国产模型的价格也越来越低。
比如一些模型的 Token 价格只有 Sonnet 5 标准价格的几十分之一。
模型能力当然不能只看价格,但对于大量简单任务来说,这个差距已经足够让开发者认真算一遍成本了。
所以现在选模型,我觉得已经不能只问:
“哪个模型效果最好?”
“这个任务用哪个模型最划算?”
最后,AI API 的成本其实越来越复杂了。
模型价格会变,Token 数量会变,缓存策略会变,模型也会不断更新。
如果项目已经上生产,最好别等到账单出来以后才发现成本突然增加。
把模型切换、Token 用量、成本监控和预警提前做好,至少知道钱到底花在哪里。
像 EasyAPI 这样的 API 中转和路由层,意义也就在这里:模型可以随时切换,成本和用量也更容易统一管理。

网硕互联帮助中心






评论前必须登录!
注册