Agent.Space 博客

GPT-6 Astra 价格:API、ChatGPT、Codex、缓存与长上下文成本

对比 GPT-6 Astra 的 API、ChatGPT 与 Codex 计费,拆解缓存写入、长上下文倍率、credits、Batch、Flex 与 Fast。

GPT-6 Astra 没有一个适用于所有入口的统一价格。你最终花多少钱,首先取决于从哪里使用它:直接调用 OpenAI API、在 ChatGPT 中使用,还是通过 Codex 使用。这些入口可能显示同一个模型名,却采用不同的套餐额度、credits、价格表和长上下文规则。

如果直接调用 API,目前 Standard 标准费率是:每百万输入 token 10 美元、每百万缓存输入 token 1 美元、每百万缓存写入 token 12.50 美元、每百万输出 token 50 美元。当一次请求的输入超过 272,000 token 时,费率会变化。ChatGPT 走套餐访问,不是照抄这张 token 账单;Codex 则可能使用 ChatGPT 套餐与符合条件的 credits,也可能使用你自己的 API key 并按 API 计费。

下文所有价格和产品规则均依据 OpenAI 官方页面,于 2026 年 9 月 7 日核验。价格可能变化,做生产预算前仍要重新检查当前价格表。

同一模型,三条计费路径

先确认实际访问路径,再记价格。这个顺序比记住一个醒目的单价更重要。

在哪里使用 Astra怎么计费首先检查什么
OpenAI APItoken、服务层、工具费用,以及适用时的长上下文倍率API 项目权限、当前模型价格表、服务层、输入量、缓存行为和输出量
ChatGPT当前套餐或工作区是否符合资格、是否轮到分批开放,以及套餐内额度账号与具体产品入口是否已开放;购买 credits 不会提前解锁
使用 ChatGPT 账号登录 Codex先消耗 Work/Codex 套餐内额度,符合条件时再使用 creditsrollout、套餐、工作区策略、当前用量和账号显示的价格表
Codex 使用自己的 API keyOpenAI API 计费API 项目权限、消费/速率上限,以及下文 API 价格

OpenAI 的 GPT-6 Astra 访问说明明确区分了 ChatGPT 套餐访问与 API key 使用方式。这个区别能避免两种常见预算错误:把 ChatGPT 订阅当成预付 API token,或者以为 API 余额能增加 ChatGPT 或 Codex 套餐额度。

如果你要先了解发布、上下文和 Coding Agent 适配,而不只是算账,可以先看 GPT-6 Astra Coding Agent 指南

GPT-6 Astra API 价格

OpenAI 官方 GPT-6 Astra 模型页给出的 Standard API 费率如下,单位均为每百万 token:

用量类别Standard 费率含义
输入$10.00本次新发送给模型的输入 token
缓存输入$1.00从符合条件的 Prompt Cache 中读取的输入 token
缓存写入$12.50写入可复用缓存的 token
输出$50.00模型生成的 token

“缓存输入”和“缓存写入”不能混为一谈。缓存写入会创建可复用条目,所以价格高于普通未缓存输入;之后真正命中缓存的读取则便宜得多。只有稳定前缀被重复使用、而且确实命中缓存时,才会产生节省。如果前缀或缓存条件变化,下次请求可能重新变成普通输入或新的缓存写入。

这些 token 费率也不一定是请求的全部成本。OpenAI 可能对部分工具另行收费,可用性也会受到速率限制、区域安排和具体产品合同影响。最终应以模型页和账号实际用量记录为准。

272K 长上下文倍率怎么算

Astra 的上下文窗口为 1,050,000 token,但当一次 API 请求包含超过 272,000 个输入 token 时,价格会变化。根据官方模型页:

  • 输入与缓存费率变为原来的 2 倍
  • 输出费率变为原来的 1.5 倍
  • 倍率作用于整次请求,不是只对超过 272,000 的那一段加价。

按 Standard API 费率计算,进入高费率档后,每百万未缓存输入为 20 美元、缓存输入为 2 美元、缓存写入为 25 美元、输出为 75 美元。

这会形成一个成本台阶。一次 271,000 输入 token 的请求和一次 273,000 输入 token 的请求,并不是只给最后 2,000 token 加一点钱;后者整次请求都会进入高费率处理。跨过这条线之前,可以删除无关文件、改进检索、拆分互不依赖的工作,或者写一份明确的交接产物。但不要为了躲开价格阈值而删掉任务真正需要的证据。

这里还有一个与产品合同有关的重要例外。OpenAI 的 Enterprise token-based 价格表写明,在其描述的合格 Work/Codex 合同中,Codex 使用 Astra 不收取额外长上下文倍率,而且 Codex 不收缓存写入费。这不代表 API 请求或每个个人账号都能沿用 Codex 例外。必须按实际使用入口所绑定的合同与用量页面判断。

Batch、Flex 与 Fast 不是同一个倍率

对于 Astra API,OpenAI 目前列出的规则是:

  • Batch: Standard API token 费率的 50%;
  • Flex: Standard API token 费率的 50%;
  • Fast: 适用 API 费率的 2 倍。

Batch 与 Flex 可以降低 token 成本,但不能自动代替交互式 Coding Agent 会话。可用性和交付方式必须适合任务。可以延迟完成的离线评测可能适合 Batch;如果用户正在工具循环中等待,延迟的价值计算就不同。

Fast 在 Work/Codex 中又是另一份合同。OpenAI 的 Business 与 Enterprise credits 价格表以及 Enterprise token 价格表,把 Astra 的 Work/Codex Fast 写为 Standard 的 2.5 倍,而不是 API 的 2 倍。因此,“Fast”并不代表所有产品共用一个倍率。

对比服务层时,应保持任务与验收条件一致。便宜的服务层如果造成超时、重试或人工接管,可能反而抬高每个验收通过结果的成本。快速服务层如果能减少交互式工作中的昂贵等待,也可能值回 token 溢价——但这是工作流计算,不是模型名字自带的结论。

ChatGPT 与 Codex 不是 API 价格表

ChatGPT 访问

随着 OpenAI 扩大 rollout,Astra 会逐步进入符合条件的 ChatGPT 套餐和工作区。这里的用量不会自动变成上面四行 API token 账单。即使是同一个账号,Chat、Work 与 Codex 的开放时间也可能不同;官方访问说明明确写明它仍在分批开放。

因此,订阅解决的是“是否符合资格”和“包含多少产品内用量”,并不等于“包含多少美元的 API”。模型选择器、套餐页面、工作区控制和当前用量页面才是有效证据。购买 credits 也不会让账号在 rollout 中提前排队。

使用 ChatGPT 账号登录 Codex

Codex 通过 ChatGPT 登录时,符合条件的 Astra 任务先消耗套餐包含的 Work/Codex 额度。有些套餐和地区可以在套餐额度耗尽后继续购买并使用 credits。OpenAI 的 个人 credits 说明强调,这些 credits 与 API credits 相互独立,而且可用性会因账号、套餐和地区而异。

对于符合 Business 与 Enterprise credits 计量条件的环境,OpenAI 当前给出的 Astra 费率是:每百万输入 token 250 credits、每百万缓存输入 25 credits、每百万输出 1,250 credits。这张表只适用于受该价格表约束的账号,不能直接套到用量页面显示不同合同的个人账号上。

Codex 使用 API key

如果 Codex 使用你自己的 OpenAI API key 认证,这项任务就是 API 工作负载。它使用对应 API 项目、权限、消费与速率上限,并按 API token 价格计费。ChatGPT 订阅或 Work/Codex credits 不会替你支付这张 API 账单。

如果需要了解更完整的套餐与访问路径,可以继续看 Codex 价格指南。这一节最重要的规则很简单:估算 Astra 成本前,先确认认证路径。

两个透明的 API 成本算例

下面只是展示算法,不代表“典型任务一定花这么多”。真实 Coding Agent 可能发出多次请求、使用工具、重试,并生成更多或更少的 token。

例 1:输入低于 272K,并复用缓存

假设一次 Standard API 请求包含:

  • 80,000 个未缓存输入 token;
  • 20,000 个缓存写入 token;
  • 100,000 个缓存输入 token;
  • 10,000 个输出 token。

预计 token 成本为:

text
未缓存输入:0.08 × $10.00  = $0.80缓存写入:  0.02 × $12.50  = $0.25缓存输入:  0.10 × $1.00   = $0.10输出:      0.01 × $50.00  = $0.50合计:                         $1.65

这个假设用量记录里的四个类别互不重叠。如果实际请求没有发生缓存命中或写入,就应按 API 返回的真实类别替换对应行。

例 2:输入超过 272K

假设一次 Standard API 请求包含 300,000 个未缓存输入 token、20,000 个缓存输入 token 和 20,000 个输出 token。由于总输入超过 272,000,整次请求都使用高费率:

text
未缓存输入:0.30 × $20.00 = $6.00缓存输入:  0.02 × $2.00  = $0.04输出:      0.02 × $75.00 = $1.50合计:                        $7.54

这个估算没有包含工具费用,也没有包含 Agent 循环中的其他请求。多步骤 Coding Agent 任务应把每次请求和重试全部相加。Coding Agent API 成本核算方法说明了如何把这些记录变成任务级估算。

按每个验收通过结果的总成本决策

每 token 单价有用,但 Coding Agent 只有在产物通过关键检查后才真正产生价值。可以用下面的口径对比路线:

text
每个验收通过结果的成本 =  (模型用量 + 工具费用 + 重试 + 修复运行 + 审查时间)  / 验收通过的任务数

只有当 Astra 增加的能力或上下文足以提高正确交付概率,并能覆盖它的总成本时,才值得使用。范围明确、可逆、能做确定性测试的工作,可以先从低成本路线开始;含糊的跨文件任务、长期调查,或者一次失败修复就很昂贵的任务,更适合把 Astra 列入候选。无论模型多强,高后果改动仍要保留权限边界和人工审查。

一次小型受控试跑,比纸面月度估算更可靠。让候选路线完成同一个代表性任务,记录真实输入、缓存、输出、重试、总耗时和人工修正,再比较已经通过验收的产物。价格、模型版本或 Agent harness 变化后,应重新跑一小组测试。

常见问题

GPT-6 Astra 是每百万 token 10 美元还是 50 美元?

两个数字对应不同的 Standard API 类别:10 美元是未缓存输入,50 美元是输出。缓存输入与缓存写入另有价格,长上下文或服务层倍率还会改变最终费用。

ChatGPT 订阅包含 Astra API 用量吗?

不包含。ChatGPT 套餐访问与 API 计费相互独立。rollout 到达账号后,套餐可能包含 ChatGPT 或 Codex 中的合格用量;使用 API key 的请求仍由 API 项目付费。

购买 Codex credits 能提前解锁 Astra 吗?

不能。OpenAI 的访问说明明确表示 credits 不会提供 early access。账号或工作区必须先通过 rollout 获得该模型。

Fast 到底是 2 倍还是 2.5 倍?

取决于产品合同。Astra API 把 Fast 列为适用 API 费率的 2 倍;OpenAI 的合格 Work/Codex 价格表则列为 Standard 的 2.5 倍。必须检查真实用量对应的入口与价格表。

Astra 输入超过 272K 都会更贵吗?

API 模型页对超过 272,000 输入 token 的请求使用高费率。Enterprise Work/Codex 价格表为其合格合同记录了 Codex 例外。不能把这个例外转用到直接 API 请求。

开始长任务前,先确认 Agent、模型路线和计费路径。打开 Agent.Space查看当前 Agent 与兼容模型选项;实时选择器才是最终依据,本文并不声称 Agent.Space 当前已经提供 Astra。