GPT-6 Astra 是什么【2026 年 9 月最新】ChatGPT 哪些套餐可用・API 价格・与 GPT-5.6 的分工
OpenAI 于 2026 年 9 月 3 日(美国时间)发布的 GPT-6 Astra,正如「凡是人能在电脑上做的事,它都能代劳」所说,是一款面向电脑操作与跨多步骤长任务的旗舰模型。OSWorld 2.0 得分 72.6%,单个任务的耗时从 GPT-5.6 Sol 的约 75 分钟缩短到约 40 分钟,减少 47%。本文先用基准测试确认改变了什么,再基于 OpenAI 的官方公告、帮助中心和模型页面,整理 ChatGPT 各套餐分别在哪里可用(Pro ¥16,800/¥30,000、Business、Enterprise 在 Chat 中为「GPT-6 Pro」;Plus ¥3,000 经由 ChatGPT Work 与 Codex;免费版・Go 不提供)、每周 50 条・200 条等上限、API 单价(输入 $10/输出 $50,为 Sol 的 2.5 倍)与 Sol・Terra・Luna 的分工,以及切换时确认提问变多、对技能文件更敏感等行为变化。

2026 年 9 月 3 日(美国时间),OpenAI 发布了新的旗舰模型 GPT-6 Astra。正如「凡是人能在电脑上做的事,它都能代劳」这句宣传语所说,这是一款面向电脑操作与跨多个步骤的长任务的模型。发布后数日内,它开始陆续推送到 ChatGPT 的 Plus、Pro、Business、Enterprise 以及 API。
不过,真正想用的时候,最先卡住的是「我的套餐到底从哪里能用」。Pro 及以上会在 Chat 的模型选择中以 GPT-6 Pro 出现;而 Plus 不会出现在聊天界面里,而是通过 ChatGPT Work 和 Codex 提供。并且 API 单价是 GPT-5.6 Sol 的 2.5 倍。
本文基于 OpenAI 的官方公告、帮助中心和模型页面,整理 GPT-6 Astra 改变了什么、ChatGPT 各套餐分别在哪里可用、上限是多少,以及在 API 上如何与 GPT-5.6 Sol、Terra、Luna 分工。
结论|先看三句话
GPT-6 Astra 与其说「答案更聪明」,不如说「工作完成得更快」。在电脑操作基准 OSWorld 2.0 上得分 72.6%(GPT-5.6 Sol 为 65.7%),单个任务的耗时从约 75 分钟缩短到约 40 分钟,减少 47%。目标是表单填写、CRM 更新、调研、资料制作这类多步骤工作。
在 ChatGPT 中,Pro(月费 ¥16,800/¥30,000)、Business、Enterprise 可在 Chat 中以「GPT-6 Pro」使用;Plus(¥3,000)通过 ChatGPT Work 和 Codex 使用;免费版和 Go 不在范围内。各套餐有每周 50 条、每周 200 条等上限。
API 为输入 $10/输出 $50(每 100 万 token),是 GPT-5.6 Sol 的 2.5 倍。先确认分类・抽取用 Luna、常规任务用 Terra、需要判断的业务用 Sol 是否已经够用,把 Astra 留给「调用多个工具并推进到底的工作」才是现实的做法。
改变了什么|比「聪明」更重要的是「快」
OpenAI 公告中最引人注目的,不是分数本身,而是耗时。下面把主要指标与 GPT-5.6 Sol 并列。
| 指标 | 衡量什么 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|
| OSWorld 2.0 | 电脑操作完成率 | 72.6% | 65.7% |
| OSWorld 2.0 耗时 | 每个任务 | 约 40 分钟 | 约 75 分钟 |
| AutomationBench | 业务自动化 | 41.4% | 18.1% |
| Agents' Last Exam | 智能体综合能力 | 59.3% | 53.6% |
| Terminal-Bench 4.0 | 终端操作 | 57.9% | 37.3% |
| FrontierMath Tier 4 | 研究级数学 | 97.6% | 83.0% |
| BenchCAD | CAD 设计 | 95.9% | 83.3% |
OSWorld 2.0 的完成率只高 7 个百分点,但耗时缩短了 47%。在 Mind2Web 上,任务完成速度也提升到 1.9 倍。也就是说,改进方向是「把同样的工作,在人能等待的时间内做完」。
OpenAI 列举的用途包括:填写网页表单、更新 CRM 中的客户记录、网络调研、撰写邮件和文档、分析科学数据、搭建网站,以及安装、测试软件和排查问题。这些都不是「返回一个答案」,而是一边操作屏幕一边推进多个阶段的工作。
另外,同样是「操作电脑」,它与 Grok Bot 这类登录你的应用并常驻运行的产品处在不同层面。Astra 是模型,它作为通过 ChatGPT Work、Codex、API 运行的智能体的「大脑」工作。
安全性的定位也变了。Astra 是在 OpenAI 的 Preparedness Framework 中,网络安全能力首次达到「Critical(重大)」级别的模型。另一方面,在测试模型是否越过禁区的 ExploitGym 蜜罐中,越界比例为 0%(GPT-5.6 Sol 为 48.2%)。OpenAI 的说法是「能做的事变多了,但不该做的事不会做」。
ChatGPT 哪些套餐可以使用
这是被问得最多的部分。OpenAI 的公告写的是「提供给所有 Plus、Pro、Business、Enterprise 用户」,但读帮助中心会发现,Chat、ChatGPT Work、Codex 的提供状况各不相同。下面结合日本的月费(含税・个人套餐)一并整理。
| 套餐 | 月费 | Chat(普通聊天) | ChatGPT Work・Codex | 上限 |
|---|---|---|---|---|
| 免费版 | ¥0 | 不提供(GPT-5.6 Luna) | 不提供 | — |
| Go | ¥1,400 | 不提供(GPT-5.6 Luna) | 不提供 | — |
| Plus | ¥3,000 | 不显示(GPT-5.6 Sol 的 Medium/High) | 陆续提供 GPT-6 Astra | 有限额度,可购买额外积分 |
| Pro $100 | ¥16,800 | GPT-6 Pro | GPT-6 Astra | GPT-6 Pro 与 GPT-5.6 Sol Pro 合计每周 50 条 |
| Pro $200 | ¥30,000 | GPT-6 Pro | GPT-6 Astra | GPT-6 Pro 每周 200 条(Sol Pro 每天 170 条,两者合计每天最多 200 条) |
| Business Standard | 面向企业 | GPT-6 Pro | GPT-6 Astra(有限额度) | GPT-6 Pro 与 Sol Pro 合计每月 15 条 |
| Business Premium | 面向企业 | GPT-6 Pro | GPT-6 Astra(可使用全部现有额度) | GPT-6 Pro 与 Sol Pro 合计每周 50 条 |
| Enterprise・Edu | 面向企业 | GPT-6 Pro | GPT-6 Astra | 由工作区管理员设置;最初两周默认关闭 |
「GPT-6 Pro」指的是基于 GPT-6 Astra 的 Pro 推理。官方公告称之为「GPT-6 Astra Pro」,帮助中心与模型选择界面则写作「GPT-6 Pro」。
ChatGPT | Chat 中需要 Pro 及以上,Plus 从 Work 和 Codex 进入
Plus 用户最容易在这里困惑。ChatGPT 价格页面的 Plus 一栏写着「GPT-6 Astra 与 GPT-5.6 的高级推理模型」「ChatGPT Work 的完整访问权限」。但帮助中心的说明如下。
- 在 Chat(普通聊天)中,Plus 只能选择 GPT-5.6 Sol 的 Medium/High,不能选择 Extra High 和 Pro
- Plus 的 GPT-6 Astra 在 ChatGPT Work 和 Codex 中「陆续提供」。额度有限,需要时可购买额外积分
- 明确写明「推送是分阶段的,Chat、Work、Codex 的提供状况可能不同」
也就是说,Plus 用户「模型选择里没有 GPT-6」不是故障而是设计。想在 Chat 里用就需要 Pro 及以上;继续用 Plus 的话,正确的入口是打开 Work 并在那里切换模型。
此外,自 9 月 4 日(日本时间)起,OpenAI 向尚无法访问 GPT-6 Astra 的 Plus、Pro、Business、Enterprise 用户发放「无法使用的每一天各 1 次额度重置权」,作为推送完成前的过渡措施。
ChatGPT Work 是什么
作为 Plus 入口的「ChatGPT Work」,在帮助中心被描述为「面向更长的多步骤工作和完成态交付物的智能体」。Chat、Work、Codex 的分工如下。
对话与日常提问
- 响应快
- Plus 的模型为 GPT-5.6 Sol
调研・分析・制作交付物
- 文档、电子表格、幻灯片、报告、Sites
- 单次执行、定时执行,或由 Gmail、Slack、GitHub 的事件触发
- Plus 也可以选择 GPT-6 Astra
软件开发
- 针对代码库的实现与修改
- 与 Work 共用额度
Work 与 Codex 消耗同一份额度。帮助中心写明「Astra 消耗额度的速度比 GPT-5.6 Sol 更快」,消耗量随任务、输入输出长度、推理强度和 Fast 模式而变化。
Codex | CLI 0.153.0 及以上可用 Astra,并可跨上下文窗口保留笔记
要在 Codex 中使用 Astra,需要 Codex CLI 0.153.0 及以上和最新的桌面应用。公告中提到,Codex 上的 Astra「可以跨上下文窗口保留笔记,无需反复把积累的细节压缩成一份摘要」。这是针对长会话中前提丢失问题的改进。
达到上限后会怎样
在 Pro $200 上,用完 GPT-6 Pro 每周 200 条后,会自动切换到 GPT-5.6 Thinking(Medium)。订阅保持不变,等待重置或选择其他模型即可。其他套餐同样在超出上限后切换到其他模型或等待。帮助中心还写道「固定的消息数并不是剩余用量的可靠指标」,这也是 Business 每 5 小时的参考值在 Astra 上为 5〜45 条这样一个区间的原因。
API 价格|与 GPT-5.6 Sol・Terra・Luna 的分工
在 API 上以 gpt-6-astra 提供。下面把每 100 万 token 的标准单价与 GPT-5.6 的三款模型并列(Standard 处理・美元)。
| 模型 | 输入 | 缓存输入 | 输出 | 超过 272K token 的输入/输出 | 定位 |
|---|---|---|---|---|---|
| GPT-6 Astra | $10.00 | $1.00 | $50.00 | $20.00/$75.00 | 最困难的端到端工作 |
| GPT-5.6 Sol | $4.00 | $0.40 | $20.00 | $8.00/$30.00 | 需要判断的专业业务的旗舰 |
| GPT-5.6 Terra | $2.00 | $0.20 | $12.00 | $4.00/$18.00 | 智能与成本的平衡 |
| GPT-5.6 Luna | $0.20 | $0.02 | $1.20 | $0.40/$1.80 | 分类・抽取等机械性处理 |
Astra 的单价是 Sol 的 2.5 倍、Terra 的 5 倍、Luna 的 50 倍。例如输入 10 万 token、输出 1 万 token 的请求,粗算为 Astra $1.50、Sol $0.60、Terra $0.32、Luna $0.03。
哪个模型负责什么
01交给 Astra 的工作
单价高,所以只留给节省时间能带来回报的工作。
- 跨多个工具的长流程 — 调研→整理→录入→汇报这类中途有人在等待的作业
- 电脑操作 — 通过 computer_use、hosted_shell 实际驱动屏幕或终端的处理
- 一次性的高难度推理 — 数学、设计、大规模代码修改等失败重来代价高的处理
02继续用 GPT-5.6 就够的工作
先确认这些是否够用,再升级到 Astra。
- Sol — 需要判断和上下文理解的专业业务。此前的旗舰
- Terra — 需要上下文理解的常规处理。摘要、草稿、咨询应对
- Luna — 分类、抽取、打标签。单价仅为 Astra 的五十分之一
切换后行为会变|提示词需要修改
OpenAI 在面向 Astra 的模型指南中明确写道它的行为与 GPT-5.6 Sol 不同,并要求重新审视提示词。要点有四。
- 确认提问变多。以前的模型会推测意图继续推进的场景,Astra 可能会提问并停下。若希望它自主推进,需明确写上「推测用户意图,倾向行动,并推进到底」
- 对指令更敏感。它擅长处理长指令,但对技能文件和 AGENTS.md 中的内容也更敏感,若其中存在矛盾,会在中途停止。OpenAI 强烈建议审计模型可访问的技能与文件
- 输出偏向列表和表格。默认给出格式化的长回复,因此需要指定文体
- 向子智能体委派的次数减少。想并行运行时,需要加入鼓励委派的指令
API 侧的迁移事项也已确定:去掉 temperature、top_p、top_logprobs;把推理的 none/minimal 换成 low 并对比;工具调用转向 Responses API。
新增的能力有三项:异步工具调用(耗时工具执行期间继续推理并发起下一次工具调用)、中途介入(通过 WebSocket 在工作进行中追加指令)、configuration_update(在保留缓存的前提下于对话中途更改推理强度)。这些都是以长时间智能体处理为前提的功能。
同价位的其他模型|Claude Fable 5.1 与 Gemini 3.7 Flash
在 Astra 发布前后,Anthropic 和 Google 也推出了新模型。把 API 单价排在一起,选项就清楚了。
Claude | Fable 5.1 同为 $10/$50,缓存读取 $0.25
9 月 1 日发布的 Claude Fable 5.1,输入 $10/输出 $50,与 Astra 同价。区别在于提示缓存的读取单价:Fable 5.1 为 $0.25(Astra 为 $1.00)。在反复读取同一段长前提的智能体处理中,这个差距会体现出来。它是在 Claude Code 流程中开发时的对比对象。
Gemini | 3.7 Flash 年底前半价,$0.75/$3.75
8 月 13 日发布的 Gemini 3.7 Flash,API 单价在 2026 年 12 月 31 日前减半,为输入 $0.75/输出 $3.75(2027 年 1 月起恢复为 $1.50/$7.50)。Google 将其定位为「面向编码与智能体的最聪明的主力模型」。它不在 Astra 的层级,而是作为 Sol 或 Terra 替代品来考虑的价格带。
现在该切换吗
可以现在切换
- Pro 或 Business 及以上,且 Chat 的模型选择中已显示「GPT-6 Pro」
- 多步骤的电脑操作或长时间智能体处理是主要用途
- 比起输出成本,更看重完成所需的时间
建议再等等
- Plus 且以 Chat 为主 — Chat 仍是 GPT-5.6 Sol。不打算用 Work 和 Codex 的话不会有差别
- 以分类・抽取・摘要为主 — Luna 或 Terra 就够,Astra 只会抬高单价
- 现有提示词依赖 AGENTS.md 或技能文件 — 不先审计就切换,会出现中途停止的行为
即使属于「建议再等等」,Pro 及以上也可以零额外费用试用「GPT-6 Pro」。在每周 50 条、每周 200 条的上限范围内,把平时的一项工作跑一遍,看看耗时是否缩短,这是最可靠的做法。
常见问题(FAQ)
总结
- GPT-6 Astra 是面向电脑操作与跨多步骤长任务的旗舰。OSWorld 2.0 得分 72.6%,耗时缩短 47%
- 在 ChatGPT 中,Pro、Business、Enterprise 可在 Chat 中以「GPT-6 Pro」使用;Plus 通过 ChatGPT Work 和 Codex 使用;免费版・Go 不提供
- 上限为 Pro $100 每周 50 条、Pro $200 每周 200 条。超出后切换到 GPT-5.6
- API 为 $10/$50,是 GPT-5.6 Sol 的 2.5 倍。先确认 Luna、Terra、Sol 是否够用
- 确认提问变多、对技能文件敏感等行为发生变化,切换前先审计提示词与 AGENTS.md
延伸阅读
- Claude Fable 5・GPT-5.5・Gemini 3.1 Pro 对比(2026 年 7 月版) — 按性能、价格、用途对比上一代三款模型
- Grok Bot 是什么 — 登录你的应用并常驻工作的智能体。与 Astra 的层级差异
- 7 款自主 AI 智能体对比 — 按交付物的落点选择智能体
- 生成式 AI(LLM)分类 — 最新收录一览
本文信息基于 2026 年 9 月 8 日时 OpenAI 在官方公告、帮助中心、模型页面公开的内容。推送是分阶段进行的,规格、价格、上限可能变更,最新信息请以官方网站为准。
本文介绍的 AI 工具
相关文章
什么是 Cloudflare OS?开源 AI 智能体工作台深度解析(架构·Gatekeeper·自托管·价格)
Cloudflare 于 2026 年 8 月 5 日开源发布 AI 智能体工作台 Cloudflare OS。本文依据官方博客与 GitHub,讲解其从零权限出发的 Gatekeeper 安全模型、经由 AI Gateway 的模型选择与成本管理、Gadget(小型自制应用)、部署到自有 Cloudflare 账户的步骤,以及价格。

Claude Fable 5、GPT-5.5、Gemini 3.1 Pro该如何选择?性能、价格、使用场景全面对比【2026年7月版】
全面对比2026年上半年三强最新旗舰模型Claude Fable 5、GPT-5.5、Gemini 3.1 Pro。以官方数据为主,涵盖基准测试表现、API定价、上下文窗口、多模态支持,以及ChatGPT Plus/Claude Pro/Google AI Pro等消费级方案的使用方法,并按用途给出选购建议。

Sakana AI Fugu 使用方法|从API密钥签发到Claude Code接入,价格、免费额度与性能解说
讲解 Sakana AI 的多智能体平台 Fugu:在 console.sakana.ai 签发API密钥、调用兼容OpenAI的API,以及与 Codex、Claude Code 的接入步骤。并介绍 Fugu/Fugu Ultra/Fugu Cyber 的区分使用、价格与免费额度的有无,以及基准测试表现。

Claude Fable 5是什么|深度解析Anthropic最新前沿模型的性能、定价与使用方法
全面解析Anthropic于2026年6月发布的最新模型Claude Fable 5。涵盖编程、知识工作、科学领域的基准测试成绩,与Mythos 5的区别,API定价及使用方法,并附官方数据说明。

四大AI编程工具深度横评 | Claude Code / Cursor / Codex / Antigravity如何选择
对比Claude Code、Cursor、Codex、Antigravity四款主流AI编程工具的特点、优势与适用场景,帮你找到最适合自己的选择。

【2026年版】革新开发者工作的20款AI工具|编程辅助、代码审查自动化、无代码建站、工作流自动化全覆盖
精选介绍2026年最新开发者向AI工具。涵盖编程辅助、代码审查自动化、无代码开发、工作流自动化等18款提升工作效率的工具。
