Codex Usage
返回限额总览/GPT-6 Astra
最近更新:2026年9月21日

GPT-6 Astra Codex 额度与使用限制

有明确限制。GPT-6 Astra 在 Codex 中受方案额度约束,且并不拥有单独的配额池,而是直接共用账号已有的 Work 与 Codex 配额。 你能获得多少用量取决于当前的 ChatGPT 订阅方案。OpenAI 官方在价格页面发布了各方案在 5 小时窗口内的本地消息估算区间(Plus 及 Business Standard 为 5~45 条,Pro $100 为 25~225 条,Pro $200 为 100~900 条),而 Business Premium 则不设 5 小时限制,提供 Standard 5 倍的内置用量,并受每周用量周期约束:

方案档位5 小时本地消息估算Astra 额度池权限每周额度
ChatGPT Plus ($20/月)5 至 45 条 本地消息 (官方估算)Work 与 Codex 中有限使用OpenAI 未公开具体数字
ChatGPT Pro $100 ($100/月)25 至 225 条 本地消息 (5x Plus 估算)可全额使用现有 Work 与 Codex 额度OpenAI 未公开具体数字
ChatGPT Pro $200 ($200/月)100 至 900 条 本地消息 (20x Plus 估算)可全额使用现有 Work 与 Codex 额度OpenAI 未公开具体数字
Business Standard ($20–$25/月)5 至 45 条 本地消息 (与 Plus 估算一致)Work 与 Codex 中有限使用OpenAI 未公开具体数字
Business Premium ($100–$125/月)无 5 小时限制 (5x Standard 内置额度)可全额使用现有 Work 与 Codex 额度按周重置(未公开具体数字上限)

这些数字是 OpenAI 官方公布的本地消息估算区间,而非保证固定的 Prompt 次数上限。实际消耗速度受到任务复杂度、模型推理行为、推理力度(Reasoning effort)、上下文长度、输入与输出 Token 数量、外部工具调用以及是否开启快速模式(Fast mode)影响。Business Premium 席位在机制上与 5 小时估算不同:官方文档明确说明 Premium 席位不设 5 小时限制,完全按周重置,并提供 Standard 席位 5 倍的内置用量。

额度扣除方式
共用 Work 与 Codex 配额

消耗方案既有内置额度池;并不存在单独隔离的消息配额。

方案权限
Plus/Std 有限 · Pro/Prem 全额

Pro $100/$200 与 Premium 可全额调配;Plus 与 Standard 仅含有限用量。

5 小时估算
Plus 5–45 · Pro 25–900

官方 5 小时区间(Pro $100 为 25–225;Pro $200 为 100–900);Premium 无 5 小时限制。

最低 CLI 版本
0.153.0 或更高版本

运行 codex --version 检查版本,配置与运行 Astra 必需。

各方案与 API 计费模式下的 Astra 限制对比

开发者经常将 API 的速率限制(如 Tier 1–5 的 RPM 与 TPM)与 ChatGPT 订阅方案的使用限额混为一谈。下表对比了 Plus、Pro $100、Pro $200 与直接使用 API Key 接入时对 Astra 的不同计费与限额机制(在 ChatGPT Business 空间中,Standard 席位与 Plus 限额一致,而 Premium 席位取消了 5 小时限制并提供 5 倍 Standard 额度)。GPT-6 Astra 于 9 月 3 日上线后的记录可参阅我们的完整 Codex 限额变更历史

最近更新:2026年9月21日。数据源自 OpenAI 帮助中心与官方定价页面的最新文档。
维度ChatGPT Plus ($20/月)ChatGPT Pro $100 ($100/月)ChatGPT Pro $200 ($200/月)OpenAI Platform API来源
额度扣除方式共用 Work 与 Codex 既有额度池,含有限 Astra 用量可将 Work 与 Codex 的全部既有额度用于 Astra可将 Work 与 Codex 的全部既有额度用于 Astra独立的组织/项目级速率限制(RPM/TPM 与每月消费限额)官方文档
5 小时用量窗口约 5 至 45 条本地消息(官方估算)约 25 至 225 条本地消息(Plus 的 5 倍估算)约 100 至 900 条本地消息(Plus 的 20 倍估算)不适用(按 API 账号 Tier 等级限制 RPM 与 TPM)官方(估算区间)
每周窗口(周限额)OpenAI 未公开具体数字OpenAI 未公开具体数字OpenAI 未公开具体数字不适用(按月度预付扣费或组织预算上限控制)未公开
达到限额后的表现正在进行的当前轮次在合理使用范围内继续完成;后续 Prompt 暂停正在进行的当前轮次在合理使用范围内继续完成;后续 Prompt 暂停正在进行的当前轮次在合理使用范围内继续完成;后续 Prompt 暂停直接返回 HTTP 429 Too Many Requests 错误响应官方文档
费用与计费结构包含在每月 $20 的订阅中(适用于 Work 与 Codex 界面)包含在每月 $100 的订阅中(5 倍 Plus 额度)包含在每月 $200 的订阅中(20 倍 Plus 额度)按 Token 计量扣费(标准模式:输入 $10/M,输出 $50/M;快速模式 Fast mode:输入 $20/M,输出 $100/M)官方文档
恢复与重置方式5 小时窗口重置、每周重置日、符合条件的个人账号付费即时重置,或储存的重置(若可用)5 小时窗口重置、每周重置日、符合条件的个人账号付费即时重置,或储存的重置(若可用)5 小时窗口重置、每周重置日、符合条件的个人账号付费即时重置,或储存的重置(若可用)速率窗口期结束或预付余额充值后立即恢复官方文档

为什么 Astra 的额度消耗明显更快?

用量效率更新(2026年9月6日)

OpenAI 表示 已针对登录 ChatGPT 账号后的长耗时、高负载工作流优化了 Astra 的订阅用量。在长尾重度场景中,完成相同 Astra 任务的订阅用量最多可降低至原先的 1/3 到 1/4,且模型输出质量不受影响。

这并不意味着每个方案的基础额度扩容了 3 到 4 倍,切勿直接将上方的本地消息估算乘以 3 或 4。OpenAI 将此项优化明确定义为特定高负载长任务下的用量减免。

从 Sol 或 Terra 切换到 Astra 后,每轮 Prompt 扣减的剩余百分比会明显变快。部分开发者曾四处寻找 是否存在 GPT-6 Sol,但目前 Astra 是唯一获官方确认的 GPT-6 模型。OpenAI 指出有五个核心因素决定了 Astra 的用量消耗速度:

1. 任务的实际执行步骤

生成整套测试用例、跨多文件重构或多轮调试排错往往需要多次往返与外部工具调用;而简单的单次提问仅需一轮交互。

2. 输入与输出的上下文体积

包含大文件、广泛的项目上下文、冗长的编译器错误日志以及大篇幅生成的代码 Diff,都会显著拉高每轮对话的 Token 成本。

3. 推理力度(Reasoning Effort)

更高的推理力度意味着模型在给出最终输出之前,会消耗更多算力用于深层规划、逻辑核验与自我纠错。

4. 快速模式(Fast Mode)

快速模式能明显加快 Astra 的生成速度(官方未公开具体加速倍率),但在支持的场景下会以 2.5 倍乘数消耗 Credits 额度(或在 API 模式下按 2 倍 Token 费率计费)。详见我们的 Codex Fast mode 速度与积分倍率指南

5. 双重限额机制:任何一个窗口打满都会暂停

Codex 同时受到 5 小时用量周期和 7 天累计周窗口的约束。即便多次长耗时的 Astra 会话始终保持在 5 小时用量上限以内,也完全可能在每周重置日到来前几天就提前耗尽周度总用量。

如果 Astra 额度的消耗速度超出了上述模型与任务因素的合理预期,请参阅 如何排查 Codex 额度消耗过快异常

ChatGPT Plus 与 Pro 方案在 Astra 上的区别

不同订阅档位对 Astra 的访问权限和额度容量有着明确区分:

ChatGPT Plus$20 / 月

有限的 Astra 用量

  • 在灰度期间包含 ChatGPT Work 与 Codex CLI 中的有限 Astra 用量(每 5 小时约 5 至 45 条本地消息)。
  • 普通 ChatGPT 网页对话界面中的 GPT-6 Pro 不包含在 Plus 方案内(详见 GPT-6 Pro 与 GPT-6 Astra 的区别)。
  • 在重度编程任务中,5 小时和每周额度会以较快速度见底。
  • 符合条件的个人账号可以在设置中付费购买即时周重置或按量积分。
ChatGPT Pro$100 或 $200 / 月

可全额调配额度运行 Astra

  • Pro $100 ($100/月): 每 5 小时约 25 至 225 条本地消息(Plus 估算的 5 倍)。
  • Pro $200 ($200/月): 每 5 小时约 100 至 900 条本地消息(Plus 估算的 20 倍)。
  • Pro $100 与 Pro $200 均可将其 Work 与 Codex 的全部既有额度用于 Astra。
  • 全面支持 Codex CLI、ChatGPT Work 及网页端,在高负载时段享有优先访问权。
  • 根据具体活动与账号资格,符合条件的账号可能会获赠储存的重置(Banked Reset)。

GPT-6 Astra 与 GPT-5.6 Sol:如何合理分配你的额度?

Astra 与 Sol 共用同一份 Work 与 Codex 额度池——二者之间没有独立的配额隔离。OpenAI 官方明确说明,Astra 消耗订阅内置 Work 与 Codex 额度的速度快于 Sol;同时官方公布的 5 小时本地消息估算区间中,Astra 的可用条数也明显低于 Sol。下方的 Token 费率表提供了官方定价维度的参考背景,但请注意,它并非订阅内置额度的固定换算公式。

方案档位GPT-5.6 Sol(5 小时估算)GPT-6 Astra(5 小时估算)
Plus / Business Standard10 至 100 条本地消息5 至 45 条本地消息
Pro 5x ($100/月)50 至 500 条本地消息25 至 225 条本地消息
Pro 20x ($200/月)200 至 2,000 条本地消息100 至 900 条本地消息
当前 Work 与 Codex 费率(每 100 万 Token)GPT-5.6 SolGPT-6 Astra
输入(Input)$4.00$10.00
缓存输入(Cached input)$0.40$1.00
输出(Output)$20.00$50.00

上述数据为 OpenAI 官方公布的参考估算及当前 Token 费率卡,并不等同于订阅内置额度的固定换算公式。订阅内置用量与按量 Token 扣费是两套独立的体系:购买的 Credits 积分以及支持按量计费的 Work/Codex 操作适用上述费率卡,而直接接入 API 则按照 API 速率限制单独计费。

OpenAI 将 GPT-6 Astra 描述为适用于最具挑战性的端到端复杂任务的最强模型,而将 GPT-5.6 Sol 描述为应对复杂专业工作的旗舰主力。官方同时明确指出,Astra 消耗 Work 与 Codex 额度的速度显著快于 Sol。因此,合理的额度分配策略非常直接:在 Sol 足以胜任的日常场景中使用 Sol;仅当任务的深层难度确实值得付出更高的额度代价时,再切换到 Astra。两种模型在单任务成本上各有侧重,取决于任务本身是否需要 Astra 的深层能力。更多官方选型建议请参阅 Codex 推荐模型指南;如果首要目标是最大程度保留额度,请参阅 GPT-5.6 Luna 使用限制指南

受控实测:Astra 对 5 小时用量仪表盘的实测影响
测试项目测试模型正确性验证运行耗时5 小时仪表盘实测变动
早期成对实验GPT-5.6 Sol57 / 57 项通过下降 3 个百分点
早期成对实验GPT-6 Astra57 / 57 项通过下降 4 个百分点
后续冻结任务实验GPT-5.6 SolMedium 推理力度112 / 112 项通过92.0 秒下降 2 个百分点
后续冻结任务实验GPT-6 AstraMedium 推理力度112 / 112 项通过109.7 秒下降 4 个百分点

在两组小型受控实验中,在确定性任务均全部通过的情况下,Astra 观察到的 5 小时仪表盘降幅均至少达到或超过 Sol。由于两次测试之间的差距幅度并不一致,因此这些实测数据并不构成固定的 Astra 与 Sol 额度消耗换算比例

对照组数据:GPT-5.6 Luna 在 Medium 推理力度下耗时 118.2 秒通过了 112 / 112 项检查,在仪表盘 1 个百分点的分辨率下未观察到可检测的 5 小时变动(0 个百分点)。

以上数据来自 Codex Usage 的第一方实测读数,并非 OpenAI 官方发布的额度指标。测试样本量极小,且客户端界面仪表盘读数仅有 1 个百分点的分辨率。切勿将这些实测数据视为典型日常用量、统计学定论或通用的换算乘数。完整的基准测试数据与测试方法请参阅 完整第一方实测报告

关于 Astra,OpenAI 官方未公开的数据与规则

OpenAI 公布了部分指标,但对许多底层机制未作披露。以下是官方已公开与未公开信息的明确界线:

1. 估算区间并非固定上限:OpenAI 公布了 Astra 的 5 小时本地消息估算区间(Plus 及 Business Standard 为 5~45 条,Pro $100 为 25~225 条,Pro $200 为 100~900 条;Business Premium 无 5 小时限制)。然而官方从未保证固定的 Prompt 次数上限——实际消耗完全取决于任务复杂度、推理力度与上下文大小。
2. 未公开每周消息上限:OpenAI 从未对任何订阅方案(包括 Astra)公布过具体的每周消息数字上限。
3. 云端任务无独立额度:云端任务(Cloud tasks)与本地消息共用同一套 5 小时与每周 Codex 额度;官方并未为云端任务提供单独的用量池。
4. 5 小时用量周期重置规则:OpenAI 对突发用量设置了 5 小时用量窗口,并在当前周期结束后、用户发送下一条 Work 或 Codex 消息时开启新的 5 小时周期。官方未公开具体的底层消耗折算公式——请在 CLI 中运行 /status 查看实际重置倒计时。

当 Astra 打满你的 Codex 限额时该怎么办?

如果在活跃轮次进行过程中达到使用限额,在满足合理使用限制的前提下,Codex 可以继续完成该轮代码编写。当该活跃轮次结束后,后续 Prompt 会被暂停,直到额度恢复。你有以下四种恢复途径:

1. 等待 5 小时用量周期重置或每周固定重置

若打满的是 5 小时用量上限,Prompt 会在当前 5 小时周期结束并开启新窗口后恢复;若耗尽的是每周累计总限额,则需要等待账号每周重置日到期自动刷新。可在终端运行 /status 查看实时倒计时。

2. 使用储存的重置(Banked Reset,若账号符合条件)

储存的重置(Banked Reset)是面向特定方案与符合条件账号的权益,其发放与过期规则依官方优惠和工作区而定。若账号有未使用的储存的重置,可在 Settings > Usage 中手动激活,立即刷新 5 小时与每周用量窗口。

3. 购买即时周重置或充值额外积分

个人 ChatGPT Plus 和 Pro 方案的符合资格用户可在 Settings > Usage 或在触发限额的应用内横幅中付费购买即时周重置(Instant Reset),直接将每周重置周期提前到当前生效;在支持的区域亦可直接充值按量付费积分。

4. 切换为 OpenAI Platform API 计费(配置 API Key)

在 Codex CLI 中配置 OpenAI API Key 登录后,请求会直接路由至 OpenAI Platform API,绕开订阅方案的 5 小时和每周额度限制,直接按 Token 扣除 API 预付余额(对 gpt-6-astra 而言,标准模式为输入 $10/M、输出 $50/M;快速模式 Fast mode 为输入 $20/M、输出 $100/M)。

如何查看你的 Codex 剩余额度与重置时间

由于 Astra 直接消耗你账号整体的 Work 与 Codex 配额,你可以随时在终端中查看实时的 5 小时与每周剩余比例:

账号用量状态示例
5-hour window42% remaining · resets in 1h 38m
Weekly window19% remaining · resets in 2d 04h
数值仅为示例。请在终端运行 /status 查看你账号的真实数据。

你也可以访问官方 ChatGPT 用量设置页面 或使用我们免费开源的本地 Codex Usage 桌面监控工具 实时跟踪 5 小时与每周百分比。注意:OpenAI 与本地工具均不会在单次 Prompt 或 Token 层面上单独归因于 Astra。

常见问题解答

GPT-6 Astra 在 Codex 中有独立的额度吗?

没有。Astra 直接消耗你既有的 Work 与 Codex 额度,并不存在单独隔离的消息配额。OpenAI 官方说明,ChatGPT Plus 与 Business Standard 仅包含有限的 Astra 用量;而 Pro $100、Pro $200 以及 Business Premium 则可以使用其全部既有额度运行 Astra。运行 Astra 会与工作空间中的其他模型共同消耗相同的 5 小时和每周额度。如果你希望在节省正常 Codex 额度的同时使用专用模型,研究预览阶段的 GPT-5.3-Codex-Spark 采用独立计量,具体请参阅 GPT-5.3-Codex-Spark 额度指南

我的方案在 5 小时内能发送多少条 Astra 消息?

OpenAI 在官方价格表中公布了 5 小时本地消息估算范围:Plus 与 Business Standard 约为 5 至 45 条本地消息,Pro $100(5 倍)约为 25 至 225 条,Pro $200(20 倍)约为 100 至 900 条。Business Premium 没有 5 小时限制,提供 5 倍于 Standard 的内置用量并按周重置。这些数值属于官方估算的参考区间,并非绝对保证的固定 Prompt 次数;实际可用次数受任务复杂度、推理力度、上下文体积及是否开启 Fast mode 影响。每周额度数字官方从未对外公开。

ChatGPT Plus 可以在 Codex 中使用 GPT-6 Astra 吗?

可以。在灰度推出期间,Plus 用户可以在 ChatGPT Work 以及 Codex CLI 中使用有限的 Astra 额度。但请注意,普通 ChatGPT 网页对话界面中的 GPT-6 Pro 并不包含在 Plus 方案内。

运行 GPT-6 Astra 最低需要哪个版本的 Codex CLI?

配置和运行 GPT-6 Astra 需要 Codex CLI 0.153.0 或更高版本。你可以在终端中运行 codex --version 查看当前安装的版本。

如果在代码生成的中途打满限额会怎样?

根据 OpenAI 官方文档,如果在活跃轮次(active turn)进行过程中达到使用限额,在满足合理使用限制的前提下,Codex 可以继续完成该轮工作。当该活跃轮次结束后,后续的 Prompt 会被暂停,直到额度恢复、添加额外积分或使用了符合条件的重置。

本地 Codex Usage 工具会单独统计 Astra 的用量吗?

不会。OpenAI 并没有在其状态接口中暴露按模型归因的 Token 或轮次数据。本地 Codex Usage 工具显示的是官方 Codex 客户端上报的账号级 5 小时与每周整体剩余百分比及重置时间,覆盖共享池内的所有模型。

如果 Astra 提前耗尽了每周 Codex 额度,该如何继续?

当额度耗尽时,你有四种选择:(1) 等待 5 小时用量周期结束重置或等待每周重置日刷新;(2) 若账号中存有未使用的储存的重置(Banked Reset),可在 Settings > Usage 中手动激活;(3) 符合条件的个人 Plus 与 Pro 账号可在 Settings > Usage 购买即时重置(Instant Reset)或添加按量积分(Credits);(4) 使用 OpenAI API Key 登录 Codex CLI,切换为按 Token 扣费的 OpenAI Platform API 模式。

按方案查看限额
重置与额度恢复
模型配置与加速