GPT 5.5 发布后,我连续使用了两天,然后把主力模型从 Claude Opus 4.7 换成了它。促使我切换的因素不只是一项跑分,而是实际交流、长任务执行、响应速度和订阅额度一起发生了变化。

OpenAI 官网的 Introducing GPT-5.5 发布页

Opus 4.7 和 GPT 5.4 各自的问题

Claude Opus 4.7 推出之后,编程能力很强,但我实际使用时觉得它的语言理解和文案输出弱了不少,写出来的内容接近 GPT 5.4。

GPT 5.4 的性价比很高,但我使用时经常遇到理解偏差。它容易钻进局部问题,写出的方案很难读懂,中文文案也比较生硬。

所以我之前使用 GPT 时,会让 Claude Code 通过子 Agent 控制 Codex。需求先经过 Claude 整理,GPT 输出的方案和结论再由 Claude 转述。这个组合能利用 GPT 的执行能力,但沟通链路很长。

GPT 5.5 的实际表现

GPT 5.5 改变了这条链路。我用它编写了一份很长的方案,内容已经可以直接阅读,不再需要 Claude 转述。以这两天的体验来看,它的文案和理解能力明显好于 GPT 5.4,接近我使用 Opus 4.6 时的感受。

编程方面,GPT 5.4 的能力就已经挺强了,GPT 5.5 会比它更强。GPT 5.5 在 Codex 里能使用的上下文上限是二十几万,我在一个对话里让它压缩了十几轮上下文,已经是一个很长的对话,它依然能够保持很好的代码执行状态。

另外,Codex 可以开启 Fast 模式,响应速度会快很多。Fast 模式的用量大约是标准模式的 1.5 倍,但按照我这两天的使用强度,整体额度仍然够用。

Codex 的模型设置菜单,Speed 里可以选 Standard 或 Fast

Claude 也有 Fast 模式,但按照我的使用强度,成本会继续增加。无论在 Cursor 里使用、购买 API,还是使用官方订阅,Claude 的额度对我都不宽裕。

Claude 的成本问题

我前两天的 Cursor 用量提供了一个直接参照。我的 Cursor 是 200 美元订阅,使用了 14 亿 token,对应额度已经消耗约 96%。

Cursor 账单后台,API 用量 14.4 亿 token,达到 95.7%

按照我连续执行编程任务的强度,14 亿 token 大约是两天的用量,也就是说这份 200 美元订阅只能支撑两天左右。我使用 Claude Opus 4.7 时还会把思考程度开到 Ultra High,这会进一步增加消耗。

Cursor 用量明细,claude-opus-4-7-thinking-xhigh 占 5.7 亿 token

在同样的价格下,我不会从 Opus 4.7 换回 Opus 4.6;Sonnet 4.6 的执行能力又无法替代 4.7。与此同时,4.7 在一些简单任务里的文案和需求理解不一定优于 Sonnet 4.6,交流感也没有那么强。这使 Claude 的几个选择都没有同时满足我的能力和成本要求。

GPT 的额度和订阅

昨天我连续使用了一整天 GPT 5.5,并且开启 Fast 模式。我的 GPT 同样是 200 美元的最高档套餐。5 小时额度最多消耗约 50%,周额度在一天后消耗了 20%。

Codex 左下角的额度,5 小时额度剩 98%,周额度剩 79%

如果换成 Cursor,同样强度的使用,一天换算成实际 API 用量可能已经达到 200 美元。但在 GPT 的订阅里,我还没有碰到 5 小时额度的上限。编程能力、理解能力和速度已经满足我的任务,额度也更宽裕,所以我停止把 Claude Opus 4.7 作为主力模型。

上下文仍然是 Codex 最明确的限制。目前还没有开放 100 万 token 的上下文,单个对话上限是 25.8 万 token。

Codex 对话的上下文用量,97k / 258k token

另外,GPT Image 2 的图像生成能力也包含在 Pro 订阅里。同一份订阅可以覆盖图像生成和 Codex 的编程任务,而且比 Anthropic Claude 的订阅容易购买。

这个切换只代表我的任务强度和使用方式。如果工作更依赖超长上下文,Claude 仍然有自己的优势。对我来说,GPT 5.5 已经解决了原来必须让 Claude 代为沟通的问题,成本差异才真正转化成了切换主力模型的理由。