GPT-5.6 来了… Claude 吓得重置了 Fable


OpenAI 一天发了俩大的

盼星星、盼月亮,今天凌晨 OpenAI 的 GPT 5.6 终于发布了

不仅如此,OpenAI 还带来了个新玩意儿,ChatGPT Work

以上这俩,均发布于今天凌晨 1 点的发布会,我也给大家录了下来,并上了中英文双字幕,尽情欣赏

当然,在做的彦祖们肯能希望量子速读…也整理出来了

然后…最搞的是…Claude 看完了发布会后,表示「我们重置了大家的额度」

然后 Codex 的负责人、主管重置的神 Tibo 表示「好怕怕哟」

那么…我这刚花了 2000+ 美金吸 Fable 的算什么

我觉得 A 社被骂,真不是没有原因的

名字

GPT-5.6 包含三款模型:

旗舰宽叫 Sol,意味太阳

均衡款叫 Terra,意思是地球

青春款叫 Luna,意思是月亮

咱也不知道这名字是跟谁学的,怎么看都像是:Opus/Sonnet/Haiku

不过也好,这次 OpenAI 也算是把模型命名规则给定了:数字+能力,比如 5.7 Sol 一定比 5.7 Luna 强;而 6.0 Luna 则一定比 5.9 Luna 新

想想吧… OpenAI 自从 1106 发布会后,模型更迭就完全放飞自我了,比如你来评估一下,这俩模型到底特么谁更强:o4-mini-high 和 4o 谁新谁旧了

跑分

不用说了…既然发了 bench,肯定在这个 bench 下面是遥遥领先,大概就是下面这个:

这次 OpenAI 还专门拿了 Agents’ Last Exam这个模型来说话,去测 55 个行业的长程专业工作流。在这场命运对决里,Sol 拿了 53.6,比 Claude Fable 5(自适应推理)高 13.1 分。而成本比 Fable 低多了

Terra 和 Luna 那边,不仅也是赢了 Fable 5 ,成本也只有十六分之一

审美

GPT 5.6 模型的审美的到来极大提升,按官方的说法,是背后的 computer use 能力上来了(还得靠 harness):模型现在会检查渲染出来的成品,视觉问题和功能问题自己发现自己修,摸完最后一遍才交稿

发布页里放了一排 demo:帆船游戏、太空游戏、博物馆网站、发条村庄游戏、室内设计演示,还有三个交互可视化,万花尺、波的干涉、GPT 分词器原理,这里我放几个过来

交互可视化 demo 视频,这里占位,发布前替换

干活

本次的另一个核心发布,是 ChatGPT Work

我觉的这东西是对表 Claude Work 的,底子是 Codex,然后做了点调教

桌面和手机上的 ChatGPT Work,任务能跨设备接力

常规办公三件套 doc/word、slids/ppt、表格/excel 啥的肯定没啥问题,而这一次的 ChatGPT work 又多了个功能 Sites:把你的工作直接变成一个可交互的网站,或者网页应用,给个 URL 就能分享给团队或公开

Sites 做的营收预测面板,官方 demo 公司叫 Blossom

产品变化

首先,桌面端的 Codex App 直接合并成了新的 ChatGPT 桌面 App

Chat、Work、Codex 三个模式装在一个 App 里,Windows 和 Mac,所有档位包括免费档都能下。老的 ChatGPT 桌面 App 改名 ChatGPT Classic

OpenAI 宣布开始逐步关停独立的 Atlas 浏览器,Chrome 扩展更新后可以在 Chrome 侧边栏里直接用 ChatGPT,官方说,这些能力吸收了 Atlas 用户的经验教训

嗯…这浏览器发布,还不到一年:OpenAI 公开 Atlas 架构:为 Agent 重新发明浏览器

Work 看完客户邮件,自己去改客户计划的 deck

最后

这套模型目前已经上线了,可以通过 ChatGPT、Codex 和 API 进行访问,Codex 客户端也来了波升级

当然大家也是分档次的

在 ChatGPT 里,Plus / Pro / Business / Enterprise 用 Sol

免费和 Go 用户用 Terra

在思考程度上,pro 和企业用户能开 ultra

            预览时标签不可点