2026年6月26日,OpenAI公布下一代大模型产品 GPT-5.6系列,推出旗舰级 Sol、均衡型 Terra、轻量化 Luna 三款定位差异化的模型,并同步开启面向可信合作伙伴的有限预览。
作为 GPT-5.6 系列的旗舰产品,Sol 定位为当前 OpenAI 能力最强的旗舰模型;Terra 主打日常办公场景的性能与成本平衡,综合表现与 GPT-5.5 具有竞争力但调用成本降低约 50%;Luna 则主打高速与高性价比,以全系最低定价提供成熟的基础 AI 能力。
OpenAI启用了全新的命名规则,数字代表模型的代际迭代,Sol、Terra、Luna 则为固定的能力档位,各档位可按照独立节奏迭代升级,为开发者与企业用户提供更清晰的算力、速度与成本选择梯度。
在技术层面,GPT-5.6系列首次引入“最大深度推理”等增强模式,可为旗舰模型 Sol 分配更充足的算力资源,支撑长链路、复杂逻辑的深度推演;同步上线的子智能体协同架构(超算增强模式)则突破了单一智能体的能力上限,通过调度多个子智能体并行协作,大幅压缩复杂任务的处理周期。
在专项基准测试中,Sol 的表现刷新了多项行业纪录:在代码领域,其在 Terminal-Bench 2.1 测试中登顶,该基准重点考核命令行工作流下的任务规划、迭代调试与多工具协同能力,标志着模型在工程化代码场景的落地能力再上台阶;在生物科研领域,在评估长周期基因组学与定量生物学分析的 GeneBench v1 测试中,Sol 不仅综合表现优于前代 GPT-5.5,完成同等任务所需的 token 数量还显著减少,推理效率大幅提升。
网络安全是本次 GPT-5.6 系列能力升级的核心赛道,官方数据显示,Sol 重新定义了长周期安全任务的“性能-效率”边界,在漏洞研究、漏洞利用等专业场景表现突出。在 ExploitBench 基准测试中,Sol 仅需约 1/3 的输出 token,即可达到对标模型 Mythos 预览版的同等水平。在由加州大学伯克利分校联合 OpenAI 等前沿实验室打造的 ExploitGym 测试中,三款模型均呈现出“推理强度越高、安全能力越强”的规律,全档位均实现明显的能力提升。
OpenAI强调,Sol 并未触及自身“预备框架”中的网络安全临界阈值,在针对 Chromium 与 Firefox 浏览器的测试中,模型可识别漏洞与攻击基础组件,但无法在测试条件下自主生成可运行的完整攻击链路,且模型在漏洞修复、防御加固场景的辅助能力,显著强于端到端攻击的执行能力。
除此之外,OpenAI 还为其构建了迄今最严密的多层安全防护体系。官方表示,单一防护手段无法应对持续迭代的恶意攻击,因此 GPT-5.6 全系列采用“模型内置约束 + 实时内容校验 + 账号级风险复核 + 分级权限管控”的叠加防护架构,三款模型根据能力等级匹配了差异化的防护配置。
训练阶段,模型即植入违规请求拒绝机制,可识别用户伪装意图与越狱尝试;生成过程中,网络安全、生物领域的专用分类器会实时扫描输出内容,高风险场景将暂停生成并由高阶模型复核上下文;针对标记的可疑行为,系统还会跨对话调取账号全局风险特征,以区分持续性恶意攻击与合法的两用技术研究。
在发布节奏上,本次 GPT-5.6 系列采用分阶段上线策略。预览阶段模型仅通过 API 与 Codex 向少量经美国政府知情的可信合作伙伴开放,后续将逐步扩大至 ChatGPT 全量用户与开发者。OpenAI 明确表态,不认可政府前置审查成为长期默认机制,认为其会阻碍普通用户、开发者与网络防御者获取先进工具;本次短期配合是为了推进后续全面开放,同时正与美国政府协作搭建可复用的未来模型发布标准化流程。
在定价方面,GPT-5.6系列按百万 token 计费:Sol 输入 5 美元、输出 30 美元;Terra 输入 2.5 美元、输出 15 美元;Luna 输入 1 美元、输出 6 美元。同时官方优化了提示词缓存机制,支持手动设置缓存断点与 30 分钟最低缓存时长,缓存写入按 1.25 倍普通输入费率计费,缓存读取维持 90% 的费用折扣。此外,GPT-5.6 Sol 将于 2026 年 7 月登陆 Cerebras 算力平台,最高输出速度可达每秒 750 token,初期仅向指定客户限量开放。
总的来看,GPT-5.6 系列的三档矩阵布局,进一步覆盖了从旗舰科研到轻量化落地的全场景需求,而“能力升级 + 安全加固 + 分阶段释放”的发布模式,也体现了前沿大模型在技术突破与风险管控之间的平衡思路。随着后续全面开放,该系列模型有望在软件工程、生命科学、网络安全防御等领域推动更多落地应用。
小编将在第一时间分享更多相关最新动态和爆料,敬请关注。