本周,多名用户在 X 平台发文称,ChatGPT 和 OpenAI 编程工具 Codex 的表现出现变化:回答更强、生成结果更完整,但等待时间也明显拉长。围绕这些现象,外界开始猜测 OpenAI 正在 ChatGPT 内部对 GPT-5.6 进行小范围测试,部分选择 GPT-5.5 Pro 的用户可能已被切换到新模型。

一些开发者贴出了对比结果,称新版本在网页设计、3D 游戏生成和代码理解上的表现更好。也有人提到,同样的提示词下,系统生成完整结果所需时间从以往约 10 分钟,拉长到 20 分钟、40 分钟,甚至超过 1 小时。

设计与 3D 任务被指提升

开发者 Anshu Chimala 发布对比视频,展示同一提示词下生成的落地页页面,称自己可能提前用上了 GPT-5.6 Pro。另一名开发者 Dobroslav Radosavljevič 也表示,Codex 当前运行的模型“感觉和 5.5 很不一样”。

Conor Dart 测试了一个单提示词生成 3D 浏览器游戏的任务,包含物理效果和镜头控制。他表示,完整生成过程耗时 60 分 15 秒,明显慢于 GPT-5.5 Pro 通常约 10 分钟的响应,但结果仍让他感到意外。

长时间响应成共同特征

目前最一致的信号不是界面变化,而是耗时上升。多名用户称,怀疑中的新模型在复杂任务上会长时间推理,重新出现早期高阶模型常见的慢响应现象。

不过,并非所有对比都支持“明显升级”的判断。X 平台上一名 AI 基准测试者称,在同一飞船建模任务中,疑似 GPT-5.6 Pro 的版本运行了 87 分钟,而 GPT-5.5 Extra High 用时 34 分 42 秒。就核心几何结构而言,Anthropic 的 Fable 5 仍优于两者。

OpenAI尚未确认发布时间

流传出的更多说法还包括:知识截止时间可能推进到 2025 年 12 月,部分测试参数被上调,SVG 和 3D 设计能力有所增强。但这些信息均未获 OpenAI 证实。

一名 AI 领域博主援引未具名消息人士称,OpenAI 可能正在向部分 Pro 用户隐蔽投放该模型,公开发布时间或在 6 月 25 日。另据 The Information 报道,OpenAI 首席科学家 Jakub Pachocki 曾向员工表示,下一代模型相比 GPT-5.5 会有“有意义的提升”。

竞争升温推高市场关注

市场对 GPT-5.6 的关注,也与近期大模型竞争升温有关。报道提到,中国开源模型 GLM-5.2 在部分工程类基准测试中已接近 Anthropic 的 Claude Opus 4.8,并超过 GPT-5.5。

与此同时,Anthropic 的 Mythos 5 和 Fable 5 仍受美国 6 月 12 日一项出口管制指令影响,暂未恢复。这给市场头部模型竞争留下空档,也让 OpenAI 的下一代模型更受关注。

补充信息:据《华尔街日报》报道,OpenAI 还在考虑下调面向开发者和企业客户的 token 定价。报道同时提到,Polymarket 上关于 GPT-5.6 在 6 月 22 日至 28 日间发布的合约,本周一度定价至 89%。