截至 2026 年 8 月 2 日,OpenAI 的官方 API 文档已把 GPT-5.6 Sol 列为 GPT-5.6 系列的前沿模型,并给出可直接调用的模型 ID、端点、价格和分层限额。这里能确认的是文档与 API 可用范围,不是一次带有发布日期的独立发布公告。

关键能力与接口

GPT-5.6 Sol 接收文本和图像、输出文本,支持推理 token、结构化输出、函数调用、文件搜索、网页搜索和提示缓存。它可通过 Chat Completions、Responses 和 Batch 使用;官方页面同时明确列出 Realtime、微调、嵌入、图像生成及音频相关端点不支持。

与既有版本的实质差异

当前公开文档最明确的版本差异在上下文和产品分层:GPT-5.6 Sol 的上下文窗口为 1,050,000 token,最大输入 922,000、最大输出 128,000;价格页把 GPT-5.5 标为低于 272K 上下文。短上下文标准输入/输出价格则都列为 5/30 美元每百万 token。来源没有给出独立基准或完整迁移说明,因此不能把上下文变化写成所有任务的能力领先。

价格与配额

  • 标准按量价格:输入 5 美元、缓存输入 0.50 美元、输出 30 美元/百万 token;超过 272K 输入的请求按长上下文价格表计费。
  • Batch 和 Flex 有单独价格;例如价格页列出的 Sol Batch 短上下文输入/输出为 2.50/15 美元每百万 token。实际账单还取决于服务模式和输入长度。
  • 标准速率限制按账户使用层级变化,Tier 1 为 500 RPM、500,000 TPM,Tier 5 为 15,000 RPM、40,000,000 TPM;高层级数字不是新账户默认配额。

对中国用户的使用判断

对需要长文档分析、代码仓库理解、复杂检索或多步专业流程的开发者,Sol 的主要价值是更大的上下文和完整的工具支持;对成本敏感或高并发场景,官方目录同时推荐 GPT-5.6 Terra 或 Luna。中国大陆是否能注册、付款或稳定调用,本文引用的模型文档没有作出确认,读者应以自己的 OpenAI API 账户状态、地区规则和最新官方说明为准。

限制与核验边界

本文没有把官方模型页的功能清单当作独立性能评测。引用页面未提供第三方基准、服务等级承诺、各地区配额或中国大陆可用性结论;这些事项需要单独核验。