核心发布信息

OpenAI 在官方 API Changelog 标明 2026 年 9 月 3 日发布 GPT-6 Astra,官方介绍称其为“最强且最对齐”的旗舰模型,面向推理、编程、计算机使用、研究与文档创作等最难的端到端工作。模型以 gpt-6-astra 为 ID,通过 v1/responses 与 v1/chat/completions 提供服务,支持流式、结构化输出、文件检索、图像输入、联网搜索、提示缓存等能力,并配套工具如 web_search、file_search、code_interpreter、hosted_shell、computer_use 等。首批面向 Trusted Access Program 的企业开放,后续将扩展至 ChatGPT Plus、Pro、Business、Enterprise 以及 Amazon Bedrock,企业管理员可在工作区按需启用,发布时默认关闭。

模型规格与接口

GPT-6 Astra 上下文窗口 105 万,最大输入 92.2 万、最大输出 12.8 万,知识截止 2026 年 4 月 30 日。输入支持文本与图像,输出为文本,支持推理 token。reasoning.effort 支持 low、medium、high、xhigh、max 五档,不支持 none;不支持自定义 temperature、top_p 及 logprobs。价格以 token 计费,标准价为输入 10 美元/百万、缓存输入 1 美元/百万、缓存写入 12.5 美元/百万、输出 50 美元/百万;当输入超过 27.2 万时整次请求按 2 倍输入与缓存费、1.5 倍输出计费,Batch 与 Flex 为标准价 5 折,Fast 为 2 倍。支持的端点包括 Chat Completions、Responses 与 Batch,Realtime、Assistants、微调等暂不支持。

新增能力与迁移要点

  • - 异步工具调用:可对 function 或 custom tool 设置 async,模型在应用执行工具期间继续推理或处理请求其他部分,完成后通过原 call_id 回传结果 - 中途转向:通过 WebSocket 在响应进行中发送额外用户指令,Responses API 将保留已完成工作并在延续中纳入更新 - 会话中调整推理力度:通过 configuration_update 输入项在不重写原始提示前缀的情况下提升或降低后续推理力度,有利于保留缓存 - misalignment monitoring:针对 Astra 级模型的异步对齐监测,必要时触发安全告警或暂停对话以供复核 - 迁移要求:工具调用必须使用 Responses API,Chat Completions 下的工具需按迁移指南调整;移除 temperature/top_p/logprobs 等不支持参数;欧盟数据驻留环境暂不支持 Fast 模式

能力表现与评测条件

官方公布的多项评测显示,GPT-6 Astra 在计算机使用与专业办公场景上较 GPT-5.6 Sol 有明显提升:OSWorld 2.0 取得 72.6%(约 40 分钟/任务)对比 65.7%(约 75 分钟/任务),ScreenSpot-Pro 无工具条件下 92.7%,Terminal-Bench 4.0 57.7%,DeepSWE v1.1 74.1%,并在 FrontierMath、ARC-AGI、自动化办公与科学推理等基准上刷新分数。官方说明评测在研究环境或通过 API 进行,可能与生产环境 ChatGPT 的系统提示与工具配置存在差异;效率对比基于延迟仿真与特定数据集,结果适用于所述评估条件,不代表所有任务均同等提升。

可用范围与适用对象

当前可用范围以 API 为主,Plus、Pro、Business、Enterprise 及 AWS 接入将在未来数日内逐步开放,现有订阅额度内可用并支持额外积分购买。对于需要长周期、跨代码与浏览器、多工具协作的企业与开发者,Astra 更适合处理复杂软件工程、专业文档与数据分析等端到端任务;轻量、高频或对成本与延迟更敏感的场景仍可继续使用 GPT-5.6 系列或选择较低推理力度以控制 token 开销。中国用户通过 API 或后续开放的 ChatGPT 渠道接入时,需关注地区与账户资格、网络与合规条件以及欧盟驻留等限制。

限制与安全

GPT-6 Astra 不支持 none 推理力度与 Fast 模式在欧盟数据驻留下的组合,工具调用与部分参数需按新规范调整。安全方面,模型在化生放核与网络攻击等高风险领域的滥用防护有所加强,Astra 级网络能力已达到内部 Preparedness Framework 的 Critical 阈值,生产版本对漏洞利用等高级任务会拒绝执行,更多能力通过 Daybreak 等受控项目逐步开放。官方同时部署了异步对齐监测与 Codex Auto-review 等系统保障,并在系统卡中披露了推理可监测性下降等问题及后续改进方向。实际使用中如遇任务暂停,需按提示复核后继续。