GPT‑5.6 发布了,但好像又没发布
- OpenAI 于 2026 年 6 月 26 日开启 GPT‑5.6 系列限量预览,一次推出旗舰 Sol、均衡型 Terra、低价型 Luna 三个模型。
- 启用新命名:数字代表「第几代」,Sol/Terra/Luna 代表「能力档位」;Terra 性能接近上一代 GPT‑5.5,价格只要一半。
- 能力提升集中在编码、生物、网络安全三块,在 Terminal‑Bench 2.1 等基准刷新纪录,但所有数据均为 OpenAI 自评,完整评测要等广泛开放时公布。
- 配套号称迄今最强的安全栈:多层防护叠加协同,并投入超 70 万 A100 等效 GPU 小时做自动化红队找通用越狱。
- 应美国政府要求先限量给少数可信伙伴(名单已报备),几周后更广开放;定价每百万 token:Sol $5/$30、Terra $2.5/$15、Luna $1/$6。
GPT‑5.6 来了,一次来仨
OpenAI 于 2026 年 6 月 26 日开启 GPT‑5.6 系列的限量预览,一次推出旗舰 Sol、均衡型 Terra 和低价型 Luna 三个模型。
这不是一次普通的版本迭代。OpenAI 把「模型能力跳级」和「政府预览流程」捆在了一起:上线前先把能力和发布计划拿给美国政府看过,并按政府要求只先开放给一小批可信伙伴,几周后才广泛放开。
为什么值得看:这是 OpenAI 首次把模型能力跃升与政府预览流程绑定发布。网络安全是这代重点提升方向,合作伙伴名单已报备政府,并投入超 70 万 A100 等效 GPU 小时做自动化红队。OpenAI 同时明说,不希望这种政府准入流程成为长期默认。
一家仨型号,到底怎么挑
同一代里摆了三档,差别在「多强、多快、多贵」。点下面任意一档,看它适合干什么。
↓ 点一档查看适用场景
新命名怎么读
以前一个数字打天下,能力档位、新旧全混在那个数字里。这次拆成两个维度:数字管「代际」,名字管「能力层级」,两边各自按自己的节奏升级。
这代到底强在哪
OpenAI 放出的能力提升集中在三块:编码、生物、网络安全。每块都给了一个基准成绩。
两个新档位:max 和 ultra
max 是让一个人想得更久;ultra 是临时拉一支小队,分头同时干。
会帮人写攻击武器吗?踩没踩红线
这代网络安全能力强了,自然有人担心:它会不会直接帮人造出攻击武器?OpenAI 给的答案是,能造「零件」,但在测试里没自己拼出「成品」。
exploitation primitives(漏洞零件)是攻击用的积木,比如一处内存越界;full‑chain exploit(完整攻击链)是把零件拼成、按下就能用的成品武器。模型能造零件,但没在测试里自己拼出能开火的那把「枪」。
在涉及 Chromium 和 Firefox 的评估里,GPT‑5.6 Sol 能找到 bug 和 exploitation primitives,但在测试条件下没有自主产出可用的完整攻击链。按 OpenAI 的 Preparedness Framework(自定的危险预案框架),它被评定为没跨过 Cyber Critical 红线,也就是没达到「具备关键攻击能力、必须触发更强管控」的那条线。
评估位置
不过基准红线盖不住模型和其他工具组合后的所有真实用法,这份不确定加上能力的整体跳级,正是这代要配上更强防护、分阶段发布的原因。
六道关卡拦住坏请求
所谓「迄今最强的安全栈」,不是一道更高的墙,而是六层防护叠起来协同工作。OpenAI 的说法很直接:面对铁了心、会随机应变的滥用者,任何单一防护都不够。
这代最特别的地方不在模型本身,而在「让模型更强」和「让滥用更难」是一起加码的:能力往上提一档,防护就多铺几层,配置还按每个型号的能力分别调。
一个危险问题在系统里走一遭
把上一节第二层「实时检查」单独拆开走一遍:一条高风险请求进来,「生成中途暂停、更大模型复审、不合规就拦下」是怎么发生的。
关键在于检查是「边生成边做」的:cyber 和 biology 分类器实时盯着模型正在吐的内容,一旦高风险情形里发现疑似违规,就把生成暂停,叫一个更大的推理模型把整段对话和上下文重读一遍。复审认定违规,这段输出就在送到用户面前之前被扣下。
用 AI 来防 AI
防护还得扛得住攻击者随时换打法。只对一份固定的已知攻击清单管用的防护,对前沿模型来说不够。所以 OpenAI 这次把大量算力投进了「让模型自己找漏洞」。
universal jailbreak(通用越狱)不是一把只能开一扇门的钥匙,而是一把万能钥匙,能跨很多提问和场景都奏效,所以最危险,红队专挑这种打。A100 等效 GPU 小时则是把算力折成「用一块 A100 显卡跑多少小时」的统一单位,70 万小时大致相当于一块卡连续跑约 80 年的算力量级。
为什么用自动化而不是纯人工?OpenAI 的理由是:让自己的模型去找弱点,能覆盖远比人工更多的攻击套路,更早发现失败规律,也能把「发现弱点」到「补上弱点」的路缩短。专攻这种更难、更通用的攻击,等于在固定的已知漏洞之外再测一层。
人工红队和快速响应怎么补位
除了自动化,OpenAI 还找了第三方测试者做大规模人类专家红队,预览期会继续。人类红队补的是创意盲区,那些系统预料不到的、靠人脑想出来的滥用方式。
OpenAI 也承认,没有任何评测能覆盖所有产品配置、多步攻击或真实工作流。所以它维持一套快速响应流程:复现、评估、排序、修补新发现的越狱,再把它加进日常评测,以后能测出同类失败。
为什么先给政府看、再给你用
这次「限量预览」不是 OpenAI 的长期意愿,而是应美国政府要求的短期一步。发布路径是这样走的。
定价:每百万 token
| 型号 | 输入 | 输出 | 定位 |
|---|---|---|---|
| Sol | $5 | $30 | 旗舰最强 |
| Terra | $2.5 | $15 | 均衡日常 |
| Luna | $1 | $6 | 最快最便宜 |
缓存方面更可预测:支持显式 cache breakpoints(自己指定缓存切点),并给出 30 分钟的最小缓存存活时长。从 GPT‑5.6 起,缓存写入按未缓存输入价的 1.25 倍计费,缓存读取继续享 90% 的折扣。
还有一条:7 月上 Cerebras
OpenAI 还计划在 7 月把 GPT‑5.6 Sol 部署到 Cerebras 上,速度可达每秒 750 个 token。这是未来计划,初期只对部分客户开放,随产能扩张再放开。
「我们不认为这种政府准入流程应该成为长期默认。它会让最好的工具无法到达真正需要它的用户、开发者、企业、网络防御者和全球伙伴手中。」OpenAI 官方博客《Previewing GPT‑5.6 Sol》
模型发布从"秀能力" → 升级成"能力和防护一起加码"
OpenAI 一次放出 Sol/Terra/Luna 三档新模型,主攻网络安全;但先限量给已报备美国政府的可信伙伴,几周后才广泛开放。
↓ 一页读完 · 有一张会动的图
GPT‑5.6 是 OpenAI 最新一代大模型(会聊天、写代码、做分析的那种 AI 系统),2026 年 6 月 26 日开启预览。它绕不开一个老难题:模型越做越能干,就越可能被人拿去干坏事。
✘ 但越强,就越可能被诱导去帮人造攻击武器、拼危险生物配方
能力和风险是一块涨的;光靠训练时教模型"拒绝",挡不住铁了心、会随机应变的人。
一口气出三档:旗舰 Sol(最强)、均衡 Terra(日常主力,性能接近上一代、价格只要一半)、低价 Luna(最快最便宜)。更大的变化,在"怎么命名"和"怎么防护"上。
OpenAI 反复强调这代配了"迄今最强的安全栈",它到底不是一句口号,长什么样、真拦得住坏请求吗?
有人担心:网络安全能力更强,会不会直接帮人造出攻击武器?OpenAI 的说法是,它能找到漏洞"零件"(比如一处程序缺陷),但在测试里没能自己把零件拼成"按下就能用"的完整攻击武器,卡在它自定的 Cyber Critical 危险红线之下。而所谓"最强安全栈",不是一道更高的墙,是六层防护叠起来协同。
官方给的提升集中在编码、生物、网络安全三块。"刷新纪录"普通人无感,换算成时间和钱更直观。拿一道网络安全漏洞利用测试(ExploitBench)来说,要打平顶尖对手模型 Mythos 的成绩,
Sol、Terra、Luna。
越可能被拿去
干坏事……
风险 ↑
挡不住会随机
应变的人。
不只秀能力!
防护就多铺几层,
一起加码。
是六道关卡叠起来。
那就摞六层?
完整攻击武器!
当场拦下
≈ 一块卡跑 80 年
造武器拦下。
谁测的?
而在把「更强」和「更难被滥用」
第一次绑一起发。
只给报备的伙伴,几周后才轮到你。
