GPT-5.6与ChatGPT Work及Codex更新全面解析

2026年7月13日

56

879

GPT-5.6与ChatGPT Work及Codex更新全面解析

2026年7月9日,OpenAI正式发布了GPT-5.6模型家族及相关产品更新。这是继此前多轮迭代之后,官方首次将模型层、产品功能层与工程工具层同步更新,标志着AI应用正在从单一模型能力输出,向更加体系化的协作平台演进。此次发布涵盖三部分核心内容:GPT-5.6提供Sol、Terra、Luna三档模型;ChatGPT Work承担长任务与可交付物产出;Codex正式并入ChatGPT桌面端,打通代码工作与产品工作的边界。对于企业和开发者而言,理解这三者的定位差异与协同关系,是高效使用这套工具集的前提。

GPT-5.6三档模型的核心定位与选择策略

在模型选择上,OpenAI将GPT-5.6划分为三个层级。旗舰级的GPT-5.6-Sol定位于复杂高价值任务,包括跨仓库重构、复杂产品研究、高阶方案撰写与难排查障;其推理强度默认设为medium,用户可根据需要提升至Pro档。均衡型的GPT-5.6-Terra以更低成本提供与上一代旗舰相当的竞争力,适合日常编码、PR评审、需求整理与常规Agent开发,是大多数团队的日常主力。轻量级的GPT-5.6-Luna主打清晰高频任务,包括分类抽取、格式转换与结构化摘要,其token价格约为Sol的五分之一,适合规则明确且可批量评测的场景。

Chat与Work的功能分野:按任务性质选择入口

三档模型均支持1,050,000 tokens上下文、922,000 tokens最大输入与128,000 tokens最大输出,可处理文本与图像输入。在API层面,GPT-5.6-Sol的输入价格为每百万tokens 5美元、输出30美元;Terra为2.5美元与15美元;Luna仅为1美元与6美元。但实际选型不应只看单次调用的token成本,还需将失败重试、工具调用、reasoning消耗与人工返工纳入计算。 在推理强度设置上,Light适合任务清晰、追求快速响应的场景;Medium为默认均衡档;High/Extra High用于多步骤、跨来源的复杂任务;Max为单一难题增加推理投入;Ultra则启动多个子智能体并行协作,适合能拆解为独立工作流的大任务。值得注意的是,Ultra的高并发特性可能快速增加用量,官方建议大多数任务无需启用Max或Ultra档位。 从Benchmark表现来看,GPT-5.6在Terminal-Bench(终端规划与工具协同)、OSWorld(桌面环境操作)与BrowseComp(自主浏览与信息整合)上表现突出,但在SWE-Bench Pro(

理解产品的分工边界,比掌握每一个功能更重要。

“行业观察”
🦞

JimoClaw — 桌面 AI Agent 工作台

让 AI 处理本地资料、操控浏览器,最终交付可直接使用的文档、表格与 PPT,而不只是一段回答。

下载桌面版

Codex桌面端集成:从专属工具到统一平台

OpenAI此次更新的一大价值在于明确了Chat、Work与Codex的分工边界。Chat适合需要即时答案、解释或短文本生成的场景;Work定位为可审阅的交付物生产,支持围绕目标持续数小时,调用文件、插件与外部工具,产出文档、表格、演示文稿乃至网站;Codex则专注于代码与工程任务,包括仓库修改、测试运行与PR审阅。 Work能力的核心在于其长任务执行与工具调用生态。用户可向Work提供文件、连接Slack、Google Drive、SharePoint、邮箱、日历、CRM与项目管理系统,并设置关键节点的人工审批。Scheduled Tasks功能允许按周期、事件或监控条件触发任务,例如每周自动汇总竞品动态、更新例会材料,或监控CI流水线变化后继续排查。这些能力使Work成为企业知识工作自动化的有力工具。

Vibe Coding与API能力:实践中的关键注意事项

7月9日起,Codex正式并入ChatGPT桌面端,覆盖macOS与Windows系统。原Codex用户的项目、设置与工作流将完整保留。对于研发团队,这意味着产品对话、代码编辑、PR审阅、终端操作与多仓库项目管理现在可以在同一应用内完成。 桌面端集成带来四项实质性提升:应用内直接编辑Markdown与代码、支持选中部分代码进行精准修改;PR审阅进入侧边栏,diff、reviewer反馈与修改建议在同一上下文呈现;跨仓库项目支持,适合前后端联动、SDK与服务端协同或应用与基础设施联动修改;GPT-5.6驱动的Computer Use能力增强,可在同一任务中处理代码、浏览器预览与桌面应用操作。 对于CLI用户,建议升级至0.144.1版本。新版本还引入writes应用审批模式:声明为只读的动作可直接运行,写操作仍需确认。这比“全部允许”或“每次都问”更符合真实Agent工作流。

🛡️

积墨 AI 安全隐患巡检系统

任务一键下达 · 隐患 AI 识别 · 整改全程留痕 · 报告一键生成。让安全巡检真正看得见、管得住、能闭环。

了解方案

如有侵权,请联系删除。

Related Articles

联系我们 试用咨询
小墨 AI