GPT-5.6 Sol
- 上下文
- 1.05M
- 输入价
- $4.00 / 百万 tokens
- 输出价
- $20.00 / 百万 tokens
- 许可
- 闭源
概览
OpenAI 当前的旗舰模型,GPT-5.6 家族中能力最强的一档,定位复杂推理、编程与长链路智能体工作流,API 别名 gpt-5.6 默认路由到它。2026-06-26 先以受限预览面向少数受信任合作伙伴开放(美国政府在公开发布前要求先行审查,由商务部 CAISI 完成评估),2026-07-09 才在 ChatGPT、Codex 与 API 全面开放。上下文窗口 1,050,000 token,最大输出 128,000 token,知识截止 2026-02-16。在公开评测里,它在 Terminal-Bench 2.1(88.8%)、BrowseComp(90.4%)、Agents' Last Exam(52.7%)上均居首,但 SWE-bench Pro 只有 64.6%,明显落后 Claude Fable 5 的 80%——OpenAI 对此的回应是质疑该基准约三成任务本身有问题。计价上有两个坑:超过 272K 输入 token 的请求整单按 2 倍输入价、1.5 倍输出价结算;缓存写入按未缓存输入价的 1.25 倍计费,缓存读取则为 $0.40 每百万 token(未缓存输入价的一成)。2026-08-21 起输入降至 $4、输出降至 $20 每百万 token,官方标注为促销价,至少持续到 2026-11-21。
- 模态
- 多模态
能力
- 超长上下文(1,050,000 token,最大输出 128,000 token)
- 智能体式编程与终端操作(Terminal-Bench 2.1 刷新纪录)
- 六档推理强度调节:none / low / medium / high / xhigh / max
- 程序化工具调用:在隔离的 V8 运行时执行模型自己写的 JavaScript,无网络访问
- 计算机操作与网页浏览(BrowseComp 90.4%,当前最佳)
- 图像输入理解、函数调用与结构化输出
- 内置工具:网页搜索、文件搜索、代码解释器、托管 Shell、MCP
基准测试
分数按各测试原始量表列示,不同测试之间不作百分比换算。
| 测试项目 | 得分 | 量表 |
|---|---|---|
| Terminal-Bench 2.1 | 88.8 | / 100 |
| BrowseComp | 90.4 | / 100 |
| SWE-bench Pro | 64.6 | / 100 |
| Agents' Last Exam | 52.7 | / 100 |
| OpenAI-MRCR v2(长上下文召回) | 73.8 | / 100 |
版本历史
2026-08 降价与提速
输入 $4.00 / 百万 tokens输出 $20.00 / 百万 tokens- 输入价下调 20%、输出价下调 33%,至 $4 / $20 每百万 token
- 促销价至少持续到 2026-11-21,同时覆盖按量付费 API、Codex 额度与符合条件的 ChatGPT Work 套餐
- 8 月 13 日公布 Ultrafast 服务档限量预览,速度最高可达标准档的 14 倍
2026-07 正式发布
上下文 1.05M输入 $5.00 / 百万 tokens输出 $30.00 / 百万 tokens- 在 ChatGPT、Codex 与 API 全面开放,取代 GPT-5.5 成为旗舰
- 首次引入缓存写入计费(未缓存输入价的 1.25 倍)与显式缓存断点、30 分钟最短缓存寿命
- 7 月 30 日起 Fast 模式取代原 Priority Processing,速度最高为标准档 2.5 倍、价格翻倍
2026-06 受限预览
- 应美国政府要求,先只向少数受信任合作伙伴开放,是美国首次在前沿模型发布前提出预先审查
- 商务部 AI 标准与创新中心(CAISI)完成审查后才解禁公开发布


