有明确限制。GPT-6 Astra 在 Codex 中受方案额度约束,且并不拥有单独的配额池,而是直接共用账号已有的 Work 与 Codex 配额。 你能获得多少用量取决于当前的 ChatGPT 订阅方案。OpenAI 官方在价格页面发布了各方案在 5 小时窗口内的本地消息估算区间(Plus 及 Business Standard 为 5~45 条,Pro $100 为 25~225 条,Pro $200 为 100~900 条),而 Business Premium 则不设 5 小时限制,提供 Standard 5 倍的内置用量,并受每周用量周期约束:
| 方案档位 | 5 小时本地消息估算 | Astra 额度池权限 | 每周额度 |
|---|---|---|---|
| ChatGPT Plus ($20/月) | 5 至 45 条 本地消息 (官方估算) | Work 与 Codex 中有限使用 | OpenAI 未公开具体数字 |
| ChatGPT Pro $100 ($100/月) | 25 至 225 条 本地消息 (5x Plus 估算) | 可全额使用现有 Work 与 Codex 额度 | OpenAI 未公开具体数字 |
| ChatGPT Pro $200 ($200/月) | 100 至 900 条 本地消息 (20x Plus 估算) | 可全额使用现有 Work 与 Codex 额度 | OpenAI 未公开具体数字 |
| Business Standard ($20–$25/月) | 5 至 45 条 本地消息 (与 Plus 估算一致) | Work 与 Codex 中有限使用 | OpenAI 未公开具体数字 |
| Business Premium ($100–$125/月) | 无 5 小时限制 (5x Standard 内置额度) | 可全额使用现有 Work 与 Codex 额度 | 按周重置(未公开具体数字上限) |
这些数字是 OpenAI 官方公布的本地消息估算区间,而非保证固定的 Prompt 次数上限。实际消耗速度受到任务复杂度、模型推理行为、推理力度(Reasoning effort)、上下文长度、输入与输出 Token 数量、外部工具调用以及是否开启快速模式(Fast mode)影响。Business Premium 席位在机制上与 5 小时估算不同:官方文档明确说明 Premium 席位不设 5 小时限制,完全按周重置,并提供 Standard 席位 5 倍的内置用量。
消耗方案既有内置额度池;并不存在单独隔离的消息配额。
Pro $100/$200 与 Premium 可全额调配;Plus 与 Standard 仅含有限用量。
官方 5 小时区间(Pro $100 为 25–225;Pro $200 为 100–900);Premium 无 5 小时限制。
运行 codex --version 检查版本,配置与运行 Astra 必需。
各方案与 API 计费模式下的 Astra 限制对比
开发者经常将 API 的速率限制(如 Tier 1–5 的 RPM 与 TPM)与 ChatGPT 订阅方案的使用限额混为一谈。下表对比了 Plus、Pro $100、Pro $200 与直接使用 API Key 接入时对 Astra 的不同计费与限额机制(在 ChatGPT Business 空间中,Standard 席位与 Plus 限额一致,而 Premium 席位取消了 5 小时限制并提供 5 倍 Standard 额度)。GPT-6 Astra 于 9 月 3 日上线后的记录可参阅我们的完整 Codex 限额变更历史。
| 维度 | ChatGPT Plus ($20/月) | ChatGPT Pro $100 ($100/月) | ChatGPT Pro $200 ($200/月) | OpenAI Platform API | 来源 |
|---|---|---|---|---|---|
| 额度扣除方式 | 共用 Work 与 Codex 既有额度池,含有限 Astra 用量 | 可将 Work 与 Codex 的全部既有额度用于 Astra | 可将 Work 与 Codex 的全部既有额度用于 Astra | 独立的组织/项目级速率限制(RPM/TPM 与每月消费限额) | 官方文档 |
| 5 小时用量窗口 | 约 5 至 45 条本地消息(官方估算) | 约 25 至 225 条本地消息(Plus 的 5 倍估算) | 约 100 至 900 条本地消息(Plus 的 20 倍估算) | 不适用(按 API 账号 Tier 等级限制 RPM 与 TPM) | 官方(估算区间) |
| 每周窗口(周限额) | OpenAI 未公开具体数字 | OpenAI 未公开具体数字 | OpenAI 未公开具体数字 | 不适用(按月度预付扣费或组织预算上限控制) | 未公开 |
| 达到限额后的表现 | 正在进行的当前轮次在合理使用范围内继续完成;后续 Prompt 暂停 | 正在进行的当前轮次在合理使用范围内继续完成;后续 Prompt 暂停 | 正在进行的当前轮次在合理使用范围内继续完成;后续 Prompt 暂停 | 直接返回 HTTP 429 Too Many Requests 错误响应 | 官方文档 |
| 费用与计费结构 | 包含在每月 $20 的订阅中(适用于 Work 与 Codex 界面) | 包含在每月 $100 的订阅中(5 倍 Plus 额度) | 包含在每月 $200 的订阅中(20 倍 Plus 额度) | 按 Token 计量扣费(标准模式:输入 $10/M,输出 $50/M;快速模式 Fast mode:输入 $20/M,输出 $100/M) | 官方文档 |
| 恢复与重置方式 | 5 小时窗口重置、每周重置日、符合条件的个人账号付费即时重置,或储存的重置(若可用) | 5 小时窗口重置、每周重置日、符合条件的个人账号付费即时重置,或储存的重置(若可用) | 5 小时窗口重置、每周重置日、符合条件的个人账号付费即时重置,或储存的重置(若可用) | 速率窗口期结束或预付余额充值后立即恢复 | 官方文档 |
为什么 Astra 的额度消耗明显更快?
OpenAI 表示 已针对登录 ChatGPT 账号后的长耗时、高负载工作流优化了 Astra 的订阅用量。在长尾重度场景中,完成相同 Astra 任务的订阅用量最多可降低至原先的 1/3 到 1/4,且模型输出质量不受影响。
这并不意味着每个方案的基础额度扩容了 3 到 4 倍,切勿直接将上方的本地消息估算乘以 3 或 4。OpenAI 将此项优化明确定义为特定高负载长任务下的用量减免。
从 Sol 或 Terra 切换到 Astra 后,每轮 Prompt 扣减的剩余百分比会明显变快。部分开发者曾四处寻找 是否存在 GPT-6 Sol,但目前 Astra 是唯一获官方确认的 GPT-6 模型。OpenAI 指出有五个核心因素决定了 Astra 的用量消耗速度:
生成整套测试用例、跨多文件重构或多轮调试排错往往需要多次往返与外部工具调用;而简单的单次提问仅需一轮交互。
包含大文件、广泛的项目上下文、冗长的编译器错误日志以及大篇幅生成的代码 Diff,都会显著拉高每轮对话的 Token 成本。
更高的推理力度意味着模型在给出最终输出之前,会消耗更多算力用于深层规划、逻辑核验与自我纠错。
快速模式能明显加快 Astra 的生成速度(官方未公开具体加速倍率),但在支持的场景下会以 2.5 倍乘数消耗 Credits 额度(或在 API 模式下按 2 倍 Token 费率计费)。详见我们的 Codex Fast mode 速度与积分倍率指南。
Codex 同时受到 5 小时用量周期和 7 天累计周窗口的约束。即便多次长耗时的 Astra 会话始终保持在 5 小时用量上限以内,也完全可能在每周重置日到来前几天就提前耗尽周度总用量。
如果 Astra 额度的消耗速度超出了上述模型与任务因素的合理预期,请参阅 如何排查 Codex 额度消耗过快异常。
ChatGPT Plus 与 Pro 方案在 Astra 上的区别
不同订阅档位对 Astra 的访问权限和额度容量有着明确区分:
有限的 Astra 用量
- 在灰度期间包含 ChatGPT Work 与 Codex CLI 中的有限 Astra 用量(每 5 小时约 5 至 45 条本地消息)。
- 普通 ChatGPT 网页对话界面中的 GPT-6 Pro 不包含在 Plus 方案内(详见 GPT-6 Pro 与 GPT-6 Astra 的区别)。
- 在重度编程任务中,5 小时和每周额度会以较快速度见底。
- 符合条件的个人账号可以在设置中付费购买即时周重置或按量积分。
可全额调配额度运行 Astra
- Pro $100 ($100/月): 每 5 小时约 25 至 225 条本地消息(Plus 估算的 5 倍)。
- Pro $200 ($200/月): 每 5 小时约 100 至 900 条本地消息(Plus 估算的 20 倍)。
- Pro $100 与 Pro $200 均可将其 Work 与 Codex 的全部既有额度用于 Astra。
- 全面支持 Codex CLI、ChatGPT Work 及网页端,在高负载时段享有优先访问权。
- 根据具体活动与账号资格,符合条件的账号可能会获赠储存的重置(Banked Reset)。
GPT-6 Astra 与 GPT-5.6 Sol:如何合理分配你的额度?
Astra 与 Sol 共用同一份 Work 与 Codex 额度池——二者之间没有独立的配额隔离。OpenAI 官方明确说明,Astra 消耗订阅内置 Work 与 Codex 额度的速度快于 Sol;同时官方公布的 5 小时本地消息估算区间中,Astra 的可用条数也明显低于 Sol。下方的 Token 费率表提供了官方定价维度的参考背景,但请注意,它并非订阅内置额度的固定换算公式。
| 方案档位 | GPT-5.6 Sol(5 小时估算) | GPT-6 Astra(5 小时估算) |
|---|---|---|
| Plus / Business Standard | 10 至 100 条本地消息 | 5 至 45 条本地消息 |
| Pro 5x ($100/月) | 50 至 500 条本地消息 | 25 至 225 条本地消息 |
| Pro 20x ($200/月) | 200 至 2,000 条本地消息 | 100 至 900 条本地消息 |
| 当前 Work 与 Codex 费率(每 100 万 Token) | GPT-5.6 Sol | GPT-6 Astra |
|---|---|---|
| 输入(Input) | $4.00 | $10.00 |
| 缓存输入(Cached input) | $0.40 | $1.00 |
| 输出(Output) | $20.00 | $50.00 |
上述数据为 OpenAI 官方公布的参考估算及当前 Token 费率卡,并不等同于订阅内置额度的固定换算公式。订阅内置用量与按量 Token 扣费是两套独立的体系:购买的 Credits 积分以及支持按量计费的 Work/Codex 操作适用上述费率卡,而直接接入 API 则按照 API 速率限制单独计费。
OpenAI 将 GPT-6 Astra 描述为适用于最具挑战性的端到端复杂任务的最强模型,而将 GPT-5.6 Sol 描述为应对复杂专业工作的旗舰主力。官方同时明确指出,Astra 消耗 Work 与 Codex 额度的速度显著快于 Sol。因此,合理的额度分配策略非常直接:在 Sol 足以胜任的日常场景中使用 Sol;仅当任务的深层难度确实值得付出更高的额度代价时,再切换到 Astra。两种模型在单任务成本上各有侧重,取决于任务本身是否需要 Astra 的深层能力。更多官方选型建议请参阅 Codex 推荐模型指南;如果首要目标是最大程度保留额度,请参阅 GPT-5.6 Luna 使用限制指南。
| 测试项目 | 测试模型 | 正确性验证 | 运行耗时 | 5 小时仪表盘实测变动 |
|---|---|---|---|---|
| 早期成对实验 | GPT-5.6 Sol | 57 / 57 项通过 | — | 下降 3 个百分点 |
| 早期成对实验 | GPT-6 Astra | 57 / 57 项通过 | — | 下降 4 个百分点 |
| 后续冻结任务实验 | GPT-5.6 SolMedium 推理力度 | 112 / 112 项通过 | 92.0 秒 | 下降 2 个百分点 |
| 后续冻结任务实验 | GPT-6 AstraMedium 推理力度 | 112 / 112 项通过 | 109.7 秒 | 下降 4 个百分点 |
在两组小型受控实验中,在确定性任务均全部通过的情况下,Astra 观察到的 5 小时仪表盘降幅均至少达到或超过 Sol。由于两次测试之间的差距幅度并不一致,因此这些实测数据并不构成固定的 Astra 与 Sol 额度消耗换算比例。
对照组数据:GPT-5.6 Luna 在 Medium 推理力度下耗时 118.2 秒通过了 112 / 112 项检查,在仪表盘 1 个百分点的分辨率下未观察到可检测的 5 小时变动(0 个百分点)。
以上数据来自 Codex Usage 的第一方实测读数,并非 OpenAI 官方发布的额度指标。测试样本量极小,且客户端界面仪表盘读数仅有 1 个百分点的分辨率。切勿将这些实测数据视为典型日常用量、统计学定论或通用的换算乘数。完整的基准测试数据与测试方法请参阅 完整第一方实测报告。
关于 Astra,OpenAI 官方未公开的数据与规则
OpenAI 公布了部分指标,但对许多底层机制未作披露。以下是官方已公开与未公开信息的明确界线:
当 Astra 打满你的 Codex 限额时该怎么办?
如果在活跃轮次进行过程中达到使用限额,在满足合理使用限制的前提下,Codex 可以继续完成该轮代码编写。当该活跃轮次结束后,后续 Prompt 会被暂停,直到额度恢复。你有以下四种恢复途径:
若打满的是 5 小时用量上限,Prompt 会在当前 5 小时周期结束并开启新窗口后恢复;若耗尽的是每周累计总限额,则需要等待账号每周重置日到期自动刷新。可在终端运行 /status 查看实时倒计时。
储存的重置(Banked Reset)是面向特定方案与符合条件账号的权益,其发放与过期规则依官方优惠和工作区而定。若账号有未使用的储存的重置,可在 Settings > Usage 中手动激活,立即刷新 5 小时与每周用量窗口。
个人 ChatGPT Plus 和 Pro 方案的符合资格用户可在 Settings > Usage 或在触发限额的应用内横幅中付费购买即时周重置(Instant Reset),直接将每周重置周期提前到当前生效;在支持的区域亦可直接充值按量付费积分。
在 Codex CLI 中配置 OpenAI API Key 登录后,请求会直接路由至 OpenAI Platform API,绕开订阅方案的 5 小时和每周额度限制,直接按 Token 扣除 API 预付余额(对 gpt-6-astra 而言,标准模式为输入 $10/M、输出 $50/M;快速模式 Fast mode 为输入 $20/M、输出 $100/M)。
如何查看你的 Codex 剩余额度与重置时间
由于 Astra 直接消耗你账号整体的 Work 与 Codex 配额,你可以随时在终端中查看实时的 5 小时与每周剩余比例:
你也可以访问官方 ChatGPT 用量设置页面 或使用我们免费开源的本地 Codex Usage 桌面监控工具 实时跟踪 5 小时与每周百分比。注意:OpenAI 与本地工具均不会在单次 Prompt 或 Token 层面上单独归因于 Astra。
常见问题解答
GPT-6 Astra 在 Codex 中有独立的额度吗?
没有。Astra 直接消耗你既有的 Work 与 Codex 额度,并不存在单独隔离的消息配额。OpenAI 官方说明,ChatGPT Plus 与 Business Standard 仅包含有限的 Astra 用量;而 Pro $100、Pro $200 以及 Business Premium 则可以使用其全部既有额度运行 Astra。运行 Astra 会与工作空间中的其他模型共同消耗相同的 5 小时和每周额度。如果你希望在节省正常 Codex 额度的同时使用专用模型,研究预览阶段的 GPT-5.3-Codex-Spark 采用独立计量,具体请参阅 GPT-5.3-Codex-Spark 额度指南。
我的方案在 5 小时内能发送多少条 Astra 消息?
OpenAI 在官方价格表中公布了 5 小时本地消息估算范围:Plus 与 Business Standard 约为 5 至 45 条本地消息,Pro $100(5 倍)约为 25 至 225 条,Pro $200(20 倍)约为 100 至 900 条。Business Premium 没有 5 小时限制,提供 5 倍于 Standard 的内置用量并按周重置。这些数值属于官方估算的参考区间,并非绝对保证的固定 Prompt 次数;实际可用次数受任务复杂度、推理力度、上下文体积及是否开启 Fast mode 影响。每周额度数字官方从未对外公开。
ChatGPT Plus 可以在 Codex 中使用 GPT-6 Astra 吗?
可以。在灰度推出期间,Plus 用户可以在 ChatGPT Work 以及 Codex CLI 中使用有限的 Astra 额度。但请注意,普通 ChatGPT 网页对话界面中的 GPT-6 Pro 并不包含在 Plus 方案内。
运行 GPT-6 Astra 最低需要哪个版本的 Codex CLI?
配置和运行 GPT-6 Astra 需要 Codex CLI 0.153.0 或更高版本。你可以在终端中运行 codex --version 查看当前安装的版本。
如果在代码生成的中途打满限额会怎样?
根据 OpenAI 官方文档,如果在活跃轮次(active turn)进行过程中达到使用限额,在满足合理使用限制的前提下,Codex 可以继续完成该轮工作。当该活跃轮次结束后,后续的 Prompt 会被暂停,直到额度恢复、添加额外积分或使用了符合条件的重置。
本地 Codex Usage 工具会单独统计 Astra 的用量吗?
不会。OpenAI 并没有在其状态接口中暴露按模型归因的 Token 或轮次数据。本地 Codex Usage 工具显示的是官方 Codex 客户端上报的账号级 5 小时与每周整体剩余百分比及重置时间,覆盖共享池内的所有模型。
如果 Astra 提前耗尽了每周 Codex 额度,该如何继续?
当额度耗尽时,你有四种选择:(1) 等待 5 小时用量周期结束重置或等待每周重置日刷新;(2) 若账号中存有未使用的储存的重置(Banked Reset),可在 Settings > Usage 中手动激活;(3) 符合条件的个人 Plus 与 Pro 账号可在 Settings > Usage 购买即时重置(Instant Reset)或添加按量积分(Credits);(4) 使用 OpenAI API Key 登录 Codex CLI,切换为按 Token 扣费的 OpenAI Platform API 模式。
- Codex 限额总览表 — 汇总各方案完整限额数据。
- ChatGPT Plus Codex 限额详解 — 深度拆解 Plus 方案细节。
- ChatGPT Pro Codex 限额指南 — 5x 与 20x 档位对比。
- ChatGPT Business Standard 与 Premium 席位限额 — 企业不同席位的 Astra 额度与 5 小时规则差异。
- Codex 用量重置时间与恢复机制 — 5 小时与每周窗口的恢复逻辑。
- Codex 积分、即时周重置、储存的重置与 API 计费 — 额度耗尽后的所有续用方案。
- 为什么在 Codex 中会遇到限流(429 错误) — 会话受限与速率错误排查。
- Codex 推荐模型与 Power 预设 — Astra 在界面模型选项中的定位与切换。
- Codex Fast mode 速度与积分倍率 — 快速模式对 Astra 生成与额度消耗的直接影响。