Codex 版本更新,上线了最新的 GPT 5.6 模型。我自己用了一整天,把实测的结果整理成了一页文档,这篇文章按照同样的顺序讲一遍。

我整理的 GPT 5.6 三档模型总结文档

三个档位和价格

这次 GPT 5.6 不像之前只分 GPT-5.5 和 GPT-5.5 Pro,它在 Codex 里分成了三个新的档位:Sol、Terra、Luna,意思分别是太阳、地球和月亮,能力从高到低。在这三个档位之外,还有一个 GPT-5.6 Pro,对标之前的 GPT-5.5 Pro。

Codex 模型菜单里的 5.6 Sol、5.6 Terra、5.6 Luna

三个档位里,Sol 对标之前的 GPT-5.5;Terra 比之前的 GPT-5.5 低一个等级,但我估计 GPT-5.6 Terra 的能力能和之前的 GPT-5.5 差不多;Luna 是更便宜的一档。这三个模型类似于 Claude 的 Opus、Sonnet 和 Haiku。

API 价格方面,GPT-5.6 Sol 和之前 GPT-5.5 一样,每 100 万 tokens 输入 5 美元、输出 30 美元;Terra 的输出是 15 美元,Luna 的输出是 6 美元。

三档模型的定位和价格,Sol 为 5 美元输入、30 美元输出

Sol 可以对标 Fable 5,价格比 Fable 5 便宜:Fable 5 是 50 美元每百万输出,Sol 是 30 美元。我自己实测下来,两个模型的能力差别不大,Sol 确实没有 Fable 5 那么强。

Ultra 思考档位和上下文长度

Codex 的界面也升级了,思考程度在 Extra High 之上新增了一个 Ultra 档位。Ultra 会非常积极地使用多个子 Agent 共同执行任务,类似 Claude Code 里面的 ultra 模式,也就是 Dynamic Workflow。在 Codex 里,这意味着它会更加积极地使用子 Agent 来推进任务,效率会更高,开销也会更高。

模型设置里的 Model、Effort、Speed 选项

上下文长度也有变化。之前 GPT-5.5 在 Codex 里最高只能用到 26 万左右,升级到 GPT-5.6 之后可以用到 35 万左右,比之前多了 10 万。不过模型本身支持 100 万上下文,Codex 依然没有开放全量。

两个界面变化

第一个在内置浏览器。现在内置浏览器的右上角可以从我们自己的浏览器导入数据。之前在内置浏览器里执行自动化任务的时候没有登录态,可能需要自己重新登录;现在从谷歌浏览器导入数据之后,登录态这些信息都会带进来,在内置浏览器里做自动化或者调试 UI 都更方便。

内置浏览器右上角的 Import data from your browser

第二个是左侧新增的 Sites 标签。之前 GPT 的企业版可以类似 Manus 一样,用 vibe coding 做一些网站,然后部署在他们的云服务上。这个功能我自己没有使用过,不确定个人订阅能不能在上面创建网站。

左侧导航新增的 Sites 页面

子 Agent 更主动了

之前在 Codex 的提示词里,子 Agent 的工具说明写得很清楚:如果我们没有明确提到要调用子 Agent,它不会去触发。现在我们没有提到,它也会主动触发子 Agent 了。界面上也给子 Agent 增加了新的 UI,不同的子 Agent 有一个小图标。

右侧显示三个已完成的子 Agent,各自带一个小图标

我的一个感受是,它自己循环的能力比之前更强了。以前我们需要在 Codex 里用 Goal 告诉它不断循环,直到完成目标;现在我们给它一个任务,它有可能自己跑两三个小时,即便不开启 Goal。它对于自己最终达成目标的理解,以及对各种工具的使用都更强、更准确,尤其是 Skill 的调用。之前假设我们的 Skill 有三四十个,其中有两三个职责重叠,它就不知道选哪一个,甚至可能一个都不用;现在它会比之前更加积极地选择 Skill 来调用。

写文档和 HTML 的变化

GPT-5.5 有一个很严重的问题,我上一期视频也提到过:它会频繁地把要说给我们听的对话直接写进产物里。比如让它做一个蓝色配色、简约克制风格的页面,它就会把「这是一个蓝色克制风格的网站」这句话写进 HTML。这些信息不是面对用户的,而是面对我们的,这是它之前写文档、做 HTML 效果很差的一个主要原因。今天我让它写文档、写 HTML 的过程中,都没有再出现类似的问题。

我让它不查看任何 Skill,直接做一个它觉得最好的 HTML 页面

下面这个页面是我让它按照它自己最喜欢的风格做的 HTML。设计能力相比之前略微有一点提升,但还是有老问题:它喜欢写字重很大、行高很小、对比度很强的非衬线文字,背景喜欢用米色或者偏灰的颜色,背后一定要加网格,再加上一点绿色的渐变。它还是有一点以前的风格,但已经没有以前那么严重了。

GPT 5.6 生成的 HTML 页面,米色背景加网格

额度消耗变快了

最后说说开销。虽然 GPT 5.6 的 API 价格和之前 GPT-5.5 一样,但实际使用的时候会发现额度不太够用。我自己订的是 200 美元的套餐,以前很难把 5 小时的额度用完;现在让它在那里跑一个任务,可能一两个小时,GPT-5.6 Sol 就能把 5 小时额度直接用完。今天一天的时间,我已经花掉了周额度的 26%,以前很少一天花这么多,而且今天的 5 小时额度还是重置过的。

额度面板:5 小时额度剩 97%,周额度剩 74%

我不确定这是因为上下文变长了,还是 Codex 调整了订阅套餐的换算比例。正常情况下 API 价格没有变,换一个模型的开销应该差别不大,所以也可能是 Codex 缩减了订阅套餐里实际可以使用的 token 额度。

不过现在我们有了其他模型可以选择。订更便宜的套餐时,可以选择 Terra 或者 Luna,也可以把这些模型作为子 Agent 使用,减少 token 的开销。