news 2026/8/1 18:13:33

别买 200 刀!深扒 Claude「真实额度」,Max 5x 才是性价比之王!

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
别买 200 刀!深扒 Claude「真实额度」,Max 5x 才是性价比之王!

PS:写在Claude 5发布前。

Anthropic 忘了给一个小数四舍五入。

就这么简单。一个程序员注意到了 Claude 网页版返回的使用量数据里,藏着一串诡异的浮点数:0.16327272727272726

17 位小数。精确得可疑。

于是他用了一套叫做Stern-Brocot树的数学方法,从这串浮点数里反推出了原始的分数。

然后对照多组数据,算出了 Claude 订阅计划的真实额度。

可能 Anthropic 也没想到,自己的定价策略,就这么被几个未取整的数字泄露了。


01|Max 5x 偷偷多给了

Claude 内部用一套叫 credits(算力积分)的单位来追踪用量。

不同模型消耗速度不同,Opus大约是Sonnet的 1.67 倍,是Haiku的 5 倍。输出又比输入贵 5 倍。

这个比例和 Claude API 定价一致。

20 美元的 Pro 套餐,5 小时额度是 55 万 credits,每周上限 500 万。这是基准线。

100 美元的 Max 5x,官方宣传是 5 倍用量。但实际测出来:5 小时额度 330 万 credits,是 Pro 的 6 倍;每周上限 4166.67 万 credits,是 Pro 的 8.33 倍。

这个套餐竟然「偷偷多给」了。

200 美元的 Max 20x 呢?5 小时额度 1100 万 credits,确实是 Pro 的 20 倍,名副其实。但每周上限 8333.33 万 credits,只有 Pro 的 16.67 倍。

也就是,Max 20x 的每周额度只比 Max 5x 多一倍,但价格是两倍。

100 美元的 Max 5x 是性价比之王。

200 美元档的溢价,主要买的是更高的峰值爆发能力,而不是更多的总工作量。

换算成 token 更直观。

Pro 用户每月能用的量,换算成 API 要花 163 美元,你付 20 美元,性价比 8.1 倍。

Max 档位的对比更有意思,5x 用户每月的 token 使用量价值 1354 美元;20x 值 2708 美元,性价比都是 13.5 倍。

注意,5x 和 20x 的性价比倍数一模一样。区别只在于总量。


02|缓存读取,完全免费

用过 Claude API 的人都知道,Anthropic 有个提示词缓存「Prompt Caching」功能。

第一次发送长文本的时候,系统会把它缓存起来。之后再调用同一段文本,就不用重复处理了。

如果你直接调用 Claude API,首次缓存写入收费 1.25 倍,之后每次读取收费 0.1 倍。

听起来还挺划算对吧?

但订阅用户的待遇爽翻了。

缓存写入按正常价格算。缓存读取则完全不计费。零。

这意味着什么?

假设你用 Claude Code 写代码,每次对话 Claude 需要重新读取你整个项目的上下文。在 API 模式下,每次读取都要收你 10% 的费用。但如果你是订阅用户,这部分钱全省了。

所以,能订阅就别用 API。

甚至在重度使用缓存的场景下,Max 5x 的性价比能到 36.7 倍。


03|一个浮点数泄露了真实额度

上面的真实额度是怎么计算出来的?

有点硬核,但很有意思。

Claude 网页版的 SSE 响应里,有一个使用量百分比。正常情况下这个数字应该是四舍五入的,比如 16%、17%。

但 Max 5x 用户看到的是0.16327272727272726

问题来了:这串小数的分母是多少?

作者用了 Stern-Brocot 树。这是一种能从任意小数反推最简分数的算法。

基本思路是二分搜索所有正分数,从 0/1 和 1/0 开始,每一步计算中位数,逐步逼近目标区间。

对于0.16327272727272726,算法找到的最简分数是 449/2750。

但这还不是真正的额度上限。因为使用量百分比 = 已用量 / 上限,而 449/2750 可能已经被约分过了。

所以需要多采几个样本,算出它们分母的最小公倍数。如果多次采样后最小公倍数稳定了,那大概率就是真实的额度上限。

最终算出来的数字是 330 万 credits(5 小时)和 4166.67 万 credits(每周)。

而这个方法可行,完全是因为那个没四舍五入的小数。


那么,不考虑恶心人的封号因素,应该怎么选?

能用订阅就用订阅。

如果你每天都重度使用 Claude,100 美元的 Max 5x 是最优解。

它给你的实际用量远高于宣传的 5 倍。缓存读取完全免费,在 Agentic Coding 场景下能省一大笔。每周限额比 Pro 高 8 倍多,性价比拉满。

Max 20x 不如买两个 5x 划算。

20 美元的 Pro 适合轻度用户。每月 2170 万 credits,Sonnet还行,Opus肯定不够。

API 完全不推荐。


参考链接

  1. suspiciously precise floats, or, how I got Claude's real limits@she_llac,2026 年 1 月 25 日。点击「阅读原文」查看。

我是木易,Top2 + 美国 Top10 CS 硕,现在是 AI 产品经理。

关注「AI信息Gap」,让 AI 成为你的外挂。


版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/30 3:55:54

AgentCPM研报生成实测:离线运行+隐私保护的高效方案

AgentCPM研报生成实测:离线运行隐私保护的高效方案 没有云端API调用,没有数据上传风险,不依赖网络连接——当一份深度行业研报需要在内部会议前两小时完成,而你手头只有未联网的笔记本电脑时,你会怎么做? …

作者头像 李华
网站建设 2026/7/30 22:39:31

Chord视频时空理解工具YOLOv8集成:实时目标检测应用开发

Chord视频时空理解工具YOLOv8集成:实时目标检测应用开发 1. 为什么需要将YOLOv8集成到视频时空理解工具中 在日常的视频分析场景中,我们常常遇到这样的问题:监控画面里突然出现异常移动,但人工回看耗时费力;电商直播…

作者头像 李华
网站建设 2026/7/30 14:58:42

Z-Image模型容器化部署:使用Docker简化安装流程

Z-Image模型容器化部署:使用Docker简化安装流程 1. 为什么需要容器化部署Z-Image 刚开始接触Z-Image时,我试过直接在本地环境安装,结果折腾了大半天。Python版本冲突、PyTorch版本不匹配、diffusers库需要从源码编译、显存占用优化参数设置…

作者头像 李华
网站建设 2026/7/28 8:27:43

ollama部署embeddinggemma-300m:300M参数模型如何实现媲美大模型的语义精度

ollama部署embeddinggemma-300m:300M参数模型如何实现媲美大模型的语义精度 你有没有试过在自己的笔记本上跑一个真正好用的嵌入模型?不是那种动辄几十GB显存、需要专业GPU服务器才能启动的庞然大物,而是——开箱即用、秒级响应、不卡顿、不…

作者头像 李华
网站建设 2026/7/31 14:04:11

MusePublic Art Studio效果实测:长尾提示词对复杂场景理解能力

MusePublic Art Studio效果实测:长尾提示词对复杂场景理解能力 1. 这不是又一个“点点点”生成器,而是一支会思考的画笔 你有没有试过这样写提示词:“一位穿靛蓝工装裤的女建筑师站在未完工的混凝土建筑工地中央,左手拿着激光测…

作者头像 李华
网站建设 2026/7/29 7:58:54

实测CTC语音唤醒模型:93%准确率的‘小云小云‘识别

实测CTC语音唤醒模型:93%准确率的小云小云识别 1. 这不是实验室里的Demo,是能装进手机的真家伙 你有没有过这样的体验:对着手机说“小云小云”,等了两秒,屏幕才慢悠悠亮起来?或者在嘈杂的厨房里喊了三遍&…

作者头像 李华