最近 AI 圈有两件和价格有关的事:GPT-5.6 Luna 模型降价 80%,GPT-5.6 Terra 降价 20%。Luna 和 Terra 都属于 GPT-5.6 系列,Luna 是最低端的一款,Terra 是中端。

Luna 降价 80% 意味着 GPT 第一次有一款模型做到了 DeepSeek 级别的价格。
GPT-5.6 Luna 的价格
在 OpenRouter 上可以看到,GPT-5.6 Luna 现在按 API 调用的输出价格是每百万 token 0.6 美元,折合人民币差不多 4 块钱一百万输出,比之前的 DeepSeek V4 Pro 还要便宜一点。

除了 API 价格调整,在 Codex 里使用 Luna 对应的 Credits 也会跟着降价,这个模型几乎属于白菜价了,可以更大量地用它执行一些繁琐的事情。
不过我不太推荐大家直接和 Luna 对话。我之前在 Codex 里直接跟它聊过,效果没有那么好。我更推荐的用法是把它作为子 Agent。之前我分享过如何创建自定义子 Agent,我自己一直有一个叫 team-mode 的 Skill,它会主动派发 GPT-5.6 Luna 的子 Agent 来探索代码,最近一周已经用了一亿多 token。

它的能力也不差,我估计跟之前的 DeepSeek V4 Pro 差不多水准,也就是能够自主驱动一个 Agent。当子 Agent 更是绰绰有余,只要不安排太重的活都没问题。
DeepSeek V4 Flash 正式版上线
就在为 GPT 降价喝彩的时候,DeepSeek 发了一个更夸张的:DeepSeek V4 Flash 的正式版上线了。之前 V4 Flash 一直是预览版,还没有正式发布。

正式版没有做其他调整,而是做了很多的后训练,能力直接超越了之前的 V4 Pro。Flash 是更低一档的模型,Pro 是旗舰级,现在更低一档的模型、和之前 Flash 相同的价格,已经超越了 V4 Pro。
官方放出的榜单也出来了,成绩已经达到 GLM-5.2 的级别。

V4 Flash 本身是一个非常便宜的模型。刚才觉得 Luna 已经很便宜了,再看 DeepSeek V4 Flash:它目前的输出价格是每百万 token 0.18 美元,也就是差不多一块多人民币一百万输出,而且这还没算 Cache 的优惠。卯足了劲一天用几亿 token,可能也就几十块钱,但几亿 token 已经是非常多了。

便宜之外,这个模型的能力很强,已经强到让很多 AI Agent 产品可以免费给大家使用的程度。
狼人杀实测
我自己实际试了一下,把 V4 Flash 放进了我们做的狼人杀游戏里。下面这些都是它输出的对话内容。

这是一个 12 人局,对话很长,它能比较好地保持提示词的遵循,输出的质量也很好。把它放到 Agent 里运行,效果肯定也不会差。
接到自己的 Agent 里,选哪个
GPT-5.6 Luna 和 DeepSeek V4 Flash,如果要接到自己的 Agent 里用,比如 Codex、比如 Claude Code,我 100% 推荐 DeepSeek V4 Flash。而且按我自己的实际感受,V4 Flash 可能比 GPT-5.6 Luna 还要更强一点。
之前 DeepSeek V4 Pro 已经用一个非常便宜的价格,让更多人用上了 Agent。现在 V4 Flash 的价格更是秒杀全场。接下来我更期待 DeepSeek V4 Pro 的表现,我觉得它可能达到 Opus、Fable 这些顶级模型的级别,跟 Kimi K3 可以相提并论。Kimi K3 虽然能力很强,但价格已经到了海外主流模型的水准,而 DeepSeek 在能力跟上的同时,价格还是保持了一如既往的便宜。
这件事的意义在于,不是所有人都像程序员一样,每个月花大几百甚至上千块钱订阅 AI 产品,大多数人一个月可能就几十块钱。现在一个月几十块钱,已经能用上一个能力很强的 Agent。
