6 比 5.6 强多少

吴诗涛 2026-09-14

上周,同事问我,6 比 5.6 强多少。我知道他问的是 GPT-6-Astra 和 GPT-5.6-Sol,可我也说不清到底强多少,于是回了句:强 0.4。

现在模型的命名似乎简单好记了不少,甚至给我一种大厂很有默契、互相避开了重复的感觉。比如聊起 5.6、6,大家想到的是 OpenAI;聊起 4.8、5、5.1,想到的又是 Anthropic。OpenAI 之前也出过 GPT-5.1,但随着新模型一轮轮发布,它也慢慢淡出了话题。即便历史上的数字有重复,放在当下聊天的语境里,倒也不太会弄混。

前两天,我重新订阅了 ChatGPT Pro,发现 GPT-5.3-Codex-Spark 还保留着独立的使用额度。这个每秒能蹦出上千个 token 的家伙,竟然一路从 5.3 撑到了 6。

为了物尽其用,我把它设成了 Codex 调用 subagent 处理简单任务时的首选模型,结果没多久就看到 GPT-5.3-Codex-Spark 即将下架 的消息。

这倒也在意料之中。毕竟从 5.3 到 5.6,再到 6,中间已经迭代了好几轮。尤其是 5.6 也用上了 Cerebras,在生成质量和速度之间选择了「我都要」。这么一来,Spark 单靠速度就更难保住自己的位置了。

这些型号让我又想起那个老问题:9.8 和 9.11 哪个大?当小数看,9.8 大;当版本号看,通常是 9.11 更新。

身处 AI 奔涌发展的浪潮,其实很少能准确说出,究竟是哪个零点几改变了什么。只是偶尔回过头,才发现一些曾经觉得遥远的事情,已经成了每天随手使用的东西。

就像小时候的那篇课文,走一步,再走一步。时代大概就是这样往前走的。