GPT-5.6 发布,Claude Fable 5 免费延期,API 成本接近前者三倍!

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

【Claude Fable 5 免费期再延长】

GPT-5.6 刚落地,Anthropic 就给 Claude Fable 5 的免费使用期“续命”。7 月 19 日是付费用户目前能看到的最后期限,在此之前,Pro、Max、Team 和 Enterprise 高级席位订阅者,仍可在现有额度内免费调用这款最强的 Claude 模型,无需额外付费。

【活动时间多次调整】

这已是 Anthropic 第二次调整时间线。最初活动截止日定在 7 月 7 日,后推至 7 月 12 日,如今又在旧节点前延长一周。Anthropic 在支持文档中称,已将推广活动延长至 2026 年 7 月 19 日太平洋时间晚上 11 点 59 分 59 秒。同时,Claude Code 每周使用额度提高 50% 的活动,也延长至同一时间。活动期间,付费用户使用 Fable 5 最多可消耗 50% 的每周订阅额度,无需额外付费。用户无需领取或手动激活权益,Fable 5 与其他 Claude 模型共用每周使用额度池。不过,Anthropic 提醒,Fable 5 消耗每周额度的速度比其他 Claude 模型快。

【延期引发“胡萝卜”梗】

接二连三地延期,让人读出几分挽留意味。大家把延期变成“永远够不到的胡萝卜”梗:Fable 5 仍在所有付费计划里,但终点临近时,“胡萝卜”就往前挪。对 Claude 和 Claude Code 重度用户来说,这体验成了循环:额度耗尽等重置,截止日期临近等延期,新规则公布后重新计算使用时间。

【可能的隐蔽策略】

联系近期动作,Anthropic 也许有隐蔽策略。此前,OpenAI 对 5.6 发布多次预热,过去一个月有多篇新闻讨论 AI 厂商价格战及后果。Fable 5 发布后,Anthropic 发言人 Reem Ateyeh 7 月 9 日表示,只要算力允许,Fable 会重回订阅套餐,并希望“尽可能快地”做到,但没给出具体时间和“容量足够”的标准。这给公司留了解释空间,比如 GPT-5.6 发布时“找到”算力,或等 5.6 抢走用户后再放回 Fable。也许 Anthropic 有意推动新行业模式,让最先进的 SOTA 模型不包含在订阅套餐,只通过 API 提供。这也给 OpenAI 操作空间,若成行业标准,两家可避开价格战,维持高利润。双方都在推进可能达 1 万亿美元估值的 IPO,价格战没好处。当然,这只是基于公开信息的推演,消费者永远是被动的。

【Fable 5 与 GPT-5.6 成本对比】

上周五,OpenAI 发布 GPT-5.6 模型系列——Sol、Terra 和 Luna,拉低 AI 编程成本。OpenAI 称“训练 GPT-5.6,让它从每个 token 中完成更多有用工作”。在 DeepSWE 基准测试中,Sol Max 以每项任务 8.39 美元成本获 73% 最高分,Fable 得 70%,每项任务成本接近 22 美元,Sol Max 得分高且成本降约 62%。在 Agents’ Last Exam 上,Sol 创 53.6 分新高,比采用自适应推理的 Fable 5 高 13 分,只使用 Medium 推理强度也比 Fable 5 高 11 分,预计成本约为后者四分之一。这种效率在较小模型上也有体现,GPT-5.6 Terra 和 Luna 在约十六分之一成本下,性能超 Fable 5。在 API 成本上,差距更大,几乎相同得分下,Fable 5 花 3,771.84 美元,GPT-5.6 Sol 仅需约 1,400 美元,Fable 5 成本接近 Sol 三倍。

【开发者调侃与用户体验】

性能、成本和订阅政策对比,引来开发者对 Anthropic 的调侃。开发者 Corey 评价 GPT-5.6 称:“我真搞不懂 OpenAI 对 GPT-5.6 的策略。找不到它涨价 50% 的日期,也找不到移出订阅套餐的日期。奇怪的是,OpenAI 员工说法和官方文档一致。明显有问题。”这是反讽,看不惯 Anthropic 围绕 Fable 5 的复杂安排:先给限时价格,预告未来涨价,临近截止又延期。一名 OpenAI 员工回复,用户可把套餐额度用于 GPT-5.6,价格不变。Corey 开玩笑说,OpenAI 应招“VP of rug pulling”副总裁。早期测试阶段,Fable 和 GPT-5.6 因监管问题都被撤回,Fable 先恢复访问,但一些团队因用不上 GPT-5.6 沮丧。GPT-5.6 重新开放后,他们认为日常工作中 GPT-5.6 更好用。

【算力去向与成本问题】

Fable 5 反复延期,Anthropic 解释是“算力不足”。那算力去哪了?对比 Claude Code 和开源替代品 OpenCode,发现 Anthropic 工具吞 token 最狠。Anthropic 工具本身有固定开销,Claude Code 处理用户提示前就烧额度。研究表明,完成“Reply with exactly: OK”简单任务,Claude Code 在用户提示词送达模型前,加载约 32,800 个 token,包括系统提示词、27 个工具定义和自动注入提醒内容,OpenCode 首轮负载约 6,900 个 token,约为前者五分之一。Claude Code 约 24,000 个 token 花在工具定义上,提供 27 个工具,含核心编程工具、后台智能体和任务编排能力。关闭全部工具,其系统提示词仍约 6,500 个 token,是 OpenCode 三倍多。这 32,800 个 token 是“平台开销”,用户付费但未完成实际工作。把模型从 Sonnet 4.5 换成 Fable 5 后,差距缩至约 3.3 倍,但 Claude Code 仍比开源工具贵,资源消耗大。从缓存效率看,OpenCode 请求前缀逐字节相同,一次写入、后续几乎免费读取,Claude Code 会话中途反复重写数万 token 缓存前缀,同一任务缓存写入量最高达 OpenCode 54 倍,缓存写入按溢价计费,用量仪表盘飙升快。这意味着用户花同样订阅费,Claude Code 完成实际任务可能只有 OpenCode 几分之一,钱烧在 Anthropic 的脚手架、工具定义和重复缓存写入上。

【子智能体成成本放大器】

子智能体是成本放大器。Hacker News 一用户称,给 Claude Code 稍大任务,它启动 7 个子智能体,预算没等子智能体完成工作就烧光,同样任务主智能体顺序执行没问题。数据显示,一个直接完成消耗 121,000 个 token 的任务,分散给两个子智能体后飙升至 513,000 个 token,达 4.2 倍。每个子智能体启动消耗一套完整系统提示和工具定义,父智能体还要读全部输出。Anthropic 会告诉用户这些吗?不会。用户只看到“额度用完了”“该等重置了”,但额度消耗在哪?多少完成任务,多少是 Anthropic 脚手架和缓存重写烧钱?普通用户分不清。

【质量与成本真相】

有人认为“花得多是因为做得好”,但测试显示,两个工具计分任务都正确完成,输出质量无差别。这种情况下,token 差距就是相同结果的成本差距。这些 token 消耗了,但没带来更好结果,去了 Anthropic 的账单。那么,在这样的情况下,消费者该如何选择合适的 AI 模型呢?

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值