半价 Claude 上线,OpenAI 却先崩了
这周 AI 圈挺热闹。前天 Anthropic 把 Claude Opus 5 放出来了。价格直接砍到旗舰的一半。同一周,OpenAI 的接口、网页和 Codex 一块儿崩了。崩了足足 111 分钟。说实话,我觉得这信号挺清楚。大模型打架打到了价格上,可稳不稳还是个问号。你平时靠 ChatGPT 干活,这事儿跟你关系不小呢。
半价旗舰,是真便宜还是套路
先说 Claude Opus 5。它的定价是每百万 token 输入 5 美元、输出 25 美元,跟上一代入门价持平,本事却接近自家的旗舰 Fable 5。价格没涨,能力上去了。你发现没,在 CursorBench 3.2 这个写代码榜单上,它跟 Fable 5 只差 0.5 个百分点。第三方测评里,它的 SWE-bench Verified 跑到 96.0%,ARC-AGI-3 拿了 30.2%,大概是第二名的 3 倍呢。

大白话讲,以前你想用顶配模型,得掏双倍钱。现在同样的事,半价就能办。我前天群里有人问,说公司每月 API 账单四千多,换这个能省一半。大概算算,一年确实能少花两三万。这账挺实在的啦,不是虚的。
111 分钟,AI 也会集体掉线
再说 OpenAI 这边的宕机。7 月 25 号傍晚,它的 API、ChatGPT 和 Codex 三线同时报错,31 个服务组件性能往下掉,大概 111 分钟才恢复。哦对,有监测说它已经连续 17 天没完全正常过。

这事为啥跟你有关?不少公司现在把客服、写代码、跑数据都接在 OpenAI 上。它一崩,活儿就卡住。我昨天刷到一个帖子,一个做跨境电商的哥们说,那天正好大促,自动回复全灭了,只能手动顶。说实话,Agent 时代听着很牛,可地基没你想的那么稳。说不定哪天你正赶稿,它也给你撂挑子吧。
AI 要管你的健康,可有人为此丢了命
还有个更扎心的。OpenAI 这周在美国推了 ChatGPT Health,18 岁以上能连 Apple Health 和医院记录,把用药、化验、睡眠这些拽进对话里,由 GPT-5.6 Sol 来答。其实数据不拿去训练,这点还算克制吧。

可就在同一天,佛罗里达有个牧师把 OpenAI 和 Altman 告了。他说长期信了 ChatGPT 的错医疗建议,耽误治疗,最后家人因为肺栓塞走了。原告要求先停掉 Health 功能。你看,AI 进医疗是好事,可一旦给错话,代价是命。你用的时候,可能就别把它当医生,顶多当个记性好的助手吧。
写代码别堆提示词,删掉八成反而更好
对了,用 AI 写代码的朋友注意呀。机器之心报道,Anthropic 在 Opus 5 上线后,把 Claude Code 的系统提示词砍了 80%,编码测试分数一点没掉。他们还搞了个 /doctor 命令,自动帮你瘦上下文。

以前我们爱写一大堆规则教 AI 怎么做事,其实模型强了,那些啰嗦指令反而添乱。你写提示词,稍微收着点,把活儿交给模型自己判断,可能更顺。其实我上周试了个新功能,少写一半说明,出来的东西反而更对路吧。
一句话收尾
说白了,这周的消息就一句:便宜的强模型来了,可别天真地以为它能随时顶上。你公司现在用哪家 AI?要是哪天它崩了,你的活儿打算怎么兜底呢?
来源:36氪、机器之心、钛媒体、至顶科技、Anthropic Blog、OpenAI Blog、Reuters、dev.to

2573

被折叠的 条评论
为什么被折叠?



