GPT-6 昨晚全量推送:ChatGPT 回答变成"小应用",OpenAI 却给自家模型标了"严重"

北京时间今天凌晨,OpenAI 把 GPT-6 推给了所有 ChatGPT 用户,顺带换上新交互 Intelligent UI——回答不再是纯文字,而是能直接上手用的"小应用"。
但同一时间刷屏的还有另一件事:OpenAI 自家的安全评估报告里,"严重(Critical)"这个词,挂在了自家模型名下。
一边全量放模型,一边自己给自己贴"严重"标签。这两件事凑在一起,才是这次更新的完整画风。
先看速览
| 事项 | 内容 |
|---|---|
| 发布时间 | 美国时间 10 月 7 日(北京时间 10 月 8 日凌晨) |
| 官方发文 | GPT-6 and Intelligent UI for everyone |
| 核心更新 | GPT-6 全量开放 + Intelligent UI 交互界面 |
| 模型家族 | Astra 旗舰 / Sol 中坚 / Luna 轻量 |
| 安全焦点 | 6.1 Sol 网络安全评级 Critical;6.1 Astra 被搁置 |
一个月,四步棋
很多人把这次当成"GPT-6 发布会",其实 GPT-6 早就发了。10 月 7 日这条,是一个月连续动作的最后一步:

9 月 4 日,旗舰 GPT-6 Astra 先行发布,官方口径是"最聪明、对齐最好的模型",很快进了 Codex 和 GitHub Copilot 的默认模型名单。
9 月 22 日,Sol 和 Luna 补位:一个当中坚,一个当轻量档,价格大约只有 GPT-5.6 系列的一半(TechCrunch 报道口径)。
9 月 29 日,剧情开始拧巴。Sol 升级成 GPT-6.1 Sol,智能体编程、电脑操作能力几乎追平旗舰 Astra,定价降到每百万 tokens 输入 2 美元、输出 10 美元(第三方渠道报价,以官网为准);同一时间 Reuters 援引内部消息:原定 10 月发布的 GPT-6.1 Astra,因内部安全测试发现问题,直接搁置。
10 月 7 日,全部用户吃上 GPT-6,Intelligent UI 上线。
Intelligent UI:回答自己长出"小应用"
这是这次对普通用户最直观的变化。
你问"这顿饭 AA 怎么分",回答里直接出现一个能填数字的分账计算器;问数学,给你能拖参数的交互图形;甚至能当场生成一个能玩的小游戏。
官方的说法是:聊天回答变成一个"渲染界面",从 Instant 到 Extra High 推理档全支持。唯一例外:Pro 档(Astra)暂时不支持。
TechCrunch 的标题更直白:ChatGPT is getting a lot more visual。
模型不再只是回答问题,它开始把工具直接长进回答里。
这事的战略意味不小。以后你在 ChatGPT 里问机票、算账、做计划,它交付的不是一个建议列表,是一个半成品应用。搜索引擎的"结果页"逻辑,正在被"交付页"替代。
三层模型,价格一路往下打

Astra 旗舰、6.1 Sol 中坚、Luna 轻量,分层很清楚:免费和 Go 用户默认 Luna,付费主力用 6.1 Sol,重度推理上 Astra。
价格是这波最容易被忽略、但分量最重的信号:Sol/Luna 发布时价格约为 GPT-5.6 系列一半,6.1 Sol 又在此基础上降了约 20%。旗舰没涨价,中坚和轻量档一路下探。
旗舰下放、中端降价,这仗不是打给用户看的,是打给竞争对手看的。
另一条线:OpenAI 自己的安全报告
这次最值得玩味的信息,藏在安全评估里。
按 OpenAI 自家的 Preparedness Framework,GPT-6.1 Sol 在网络安全能力上被标为 Critical(严重),生物/化学能力为 High。
注意,这不是外部监管给的标签,是 OpenAI 内部评估的结论。而据 Reuters/WSJ 报道,更强的 6.1 Astra 直接因为内部安全测试被搁置,原定发布取消。
OpenAI 自己的安全框架,成了自家旗舰升级路上最大的减速带。
对一个天天跟自动化打交道的运维来说,这个信号比模型分数重要:当模型厂商自己都开始把"能干危险活"写成正式评级,智能体的权限边界、审计、回滚,就是接下来每个用 AI 干活的人绕不开的功课。
网传的那些"猛料",先放一放
这两天流传的几个说法,逐条对了一遍官方口径:
- "Codex 正整合 Astra 做多智能体协作"——官方页面只写了模型进了 Codex,多智能体协作没有出处;
- "Astra 十万亿参数 MoE"——纯传闻,官方从未提及;
- "Symphony 原生多模态架构 / 200 万 token 上下文 / 比 GPT-5.4 提升 40%"——官方原文查无实据。
传闻归传闻,能落地的已经够多了。
对普通开发者,该做什么
- API 降价的窗口来了:重度用中端档做日常任务的,6.1 Sol 的 $2/$10 值得算一遍账,该切就切;
- Codex 用户留意拥塞:9 月底 Hacker News 上已经有 Astra 慢、挤的反馈,关键任务错峰跑,别把发布日当压测日;
- 想清楚"交付界面"这步棋:如果自己的产品还停在"模型输出文字",可以研究 Intelligent UI 的思路——用户要的越来越不是答案,是能直接用的东西。
🎯 老张建议
- 免费/Go 用户:今天打开 ChatGPT 就能体验 Intelligent UI,重点试算账、做计划这两类问题,体感差异最明显;
- API 用户:把日常任务迁到 6.1 Sol 先跑两周,价格优势摆在那里;
- 做智能体的:把这次"自家标 Critical + 旗舰搁置"当成行业风向,权限收敛和审计日志早点做,比事后补救便宜。
💬 互动话题
- 你的 ChatGPT 收到 GPT-6 和新界面了吗?体感如何?
- 模型厂商自己给模型标"严重",你觉得是负责任,还是营销?
- Codex 和 Claude Code,你现在主力用哪个?
🔗 关注老张
公众号:老张聊运维 小程序:观简国学 个人博客:https://www.shanwaiyun.top/