OpenAI深夜发布GPT-5.6:三大版本全面对标竞品,性能与安全双线突破

2026年6月27日

69

385

OpenAI深夜发布GPT-5.6:三大版本全面对标竞品,性能与安全双线突破

近日,OpenAI正式发布了备受瞩目的新一代闭源大模型——GPT-5.6。这一次,OpenAI采用了与以往截然不同的产品策略,一口气推出了三个定位各异的版本:Sol、Terra和Luna。这一举措被业界解读为对竞争对手的全面围剿,尤其是在编程、科研和安全等多个关键领域展开了凌厉的攻势。

概述

从命名策略来看,Sol定位为旗舰级高性能版本,对标此前的Pro档位;Terra则主打中等性能区间,适合对成本和效果有均衡需求的用户;而Luna则强调快速响应和经济实惠,对应之前的Mini系列。三个版本形成了完整的产品矩阵,覆盖从高端到入门级的不同市场需求。

性能突破:编程基准测试刷新纪录

在业界熟知的编程能力基准测试TerminalBench 2.1中,GPT-5.6系列的表现堪称炸裂。旗舰版本Sol的跑分已经超越了竞品的最新旗舰模型。尤为值得关注的是,当启用新增的Ultra推理模式后,分数一举突破90%大关。这一数字的意义非凡——当某项基准测试的得分超过90%,通常意味着该基准测试本身已经接近失效,因为模型的能力已经远超其考察范围。此外,在生物科学领域,面向长周期基因组学和定量生物分析的GeneBench V1测试中,GPT-5.6在保持相同Token输出的条件下,分数已全面超越前代产品。

当模型的基准测试得分超过90%,意味着这个基准测试本身已经接近失效。

“行业观察”
🦞

JimoClaw — 桌面 AI Agent 工作台

让 AI 处理本地资料、操控浏览器,最终交付可直接使用的文档、表格与 PPT,而不只是一段回答。

下载桌面版

安全能力:重金投入构建防护体系

面对日益严峻的安全挑战,OpenAI在新一代模型的安全性上投入了前所未有的资源。在漏洞利用基准测试ExploitBench上,GPT-5.6 Sol以更少的Token消耗逼近了竞品的水平。更具创新意义的是,OpenAI与加州大学伯克利分校的研究者合作推出了全新基准测试ExploitGym,结果显示GPT-5.6全系模型的安全防御能力都随着推理能力的增强而同步提升。在安全测试的投入规模上,OpenAI更是毫不吝啬——投入了相当于70万个A100 GPU小时的算力进行自动化红队测试,专门针对能够在多种场景下生效的通用型越狱攻击。同时,还与第三方专业测试团队合作,开展了大量人类专家参与的红队测试,形成了自动化与人工测试的双重保障。

定价策略与开放节奏

目前,GPT-5.6仍处于预览阶段,仅通过API方式向指定合作伙伴开放。具体面向更广泛用户的开放时间尚未公布。在定价方面,旗舰版Sol的百万Token费用为输入5美元、输出30美元;Terra版本为输入2.5美元、输出15美元;Luna版本则最为经济,分别为1美元和6美元。新模型还引入了更可预测的提示缓存机制,支持显式缓存断点,有效期至少30分钟。缓存写入按未缓存输入价格的1.25倍计费,缓存读取则可享受90%的输入折扣优惠。此外,OpenAI预告将在7月份通过Cerebras平台上线更高速的GPT-5.6 Sol版本,推理速度可达每秒750个Token。

🛡️

积墨 AI 安全隐患巡检系统

任务一键下达 · 隐患 AI 识别 · 整改全程留痕 · 报告一键生成。让安全巡检真正看得见、管得住、能闭环。

了解方案

如有侵权,请联系删除。

Related Articles

联系我们 试用咨询
小墨 AI