价格计费
按实际 Token 用量计算。这里展示本站当前采用的费率,与账户费用统计使用同一份价格表。2026 年 9 月 1 日 00:00(北京时间)起采用下列费率,此前费用保持不变。
· 手机端可左右滑动价格表。
| 模型 | 输入 | 缓存输入 | 缓存写入 | 输出 |
|---|---|---|---|---|
| gpt-6-astra | $10.00 | $1.00 | $12.50 | $50.00 |
| gpt-5.6-sol | $4.00 | $0.40 | $5.00 | $20.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 |
| gpt-5.5 | $5.00 | $0.50 | — | $30.00 |
| gpt-5.4 | $2.50 | $0.25 | — | $15.00 |
| gpt-5.4-mini | $0.75 | $0.075 | — | $4.50 |
单价核对日期:2026-09-05。来源:OpenAI 官方 API 定价。Sol 优惠价至少持续到 2026-11-21;未来价格变化需更新本站费率。
费用如何计算
费用 =(普通输入 Token × 输入价 + 缓存读取 Token × 缓存输入价 + 缓存写入 Token × 写入价 + 输出 Token × 输出价)÷ 1,000,000。
普通输入为输入总量扣除已单独计价的缓存读取和写入部分;不重复收费。未单列写入价格的旧模型按普通输入计。推理 Token 已包含在输出统计中,不额外累加。
超过 272K 的请求如何计费
以单次请求的实际输入总量为准,包含缓存 Token。超过 272,000 才触发,恰好 272,000 不触发;258K 不是计费门槛,也不按整段对话的累计 Token 判断。
Astra 和 5.6 系列触发后,整次请求的普通输入、缓存读取及写入单价乘 2,输出单价乘 1.5;5.5 和 5.4 的 Standard 也适用长上下文价格。不是仅对超出 272K 的部分加价。 上方勾选“长上下文”可查看各模型对应单价。
以 GPT-5.6 Sol Standard 为例:普通输入/输出每百万 Token 从 $4/$20 变为 $8/$30,缓存读取/写入从 $0.40/$5 变为 $0.80/$10。一条零缓存、500,000 输入和 1,000 输出的请求,费用为 500,000 × $8 ÷ 1,000,000 + 1,000 × $30 ÷ 1,000,000 = $4.03。
提高客户端上下文预算本身不收费,实际请求达到门槛才改变单价。后续请求若继续携带超过 272K 的历史,也按长上下文价格计费。配置方法见接入指南中的“可选:开启超过 272K 的上下文”小节。
服务模式
当前接入使用 Standard 模式,不开放 Fast 切换。历史调用仍按当时实际服务档位计费,重置额度不会改变历史费用。
上方切换仅用于查看价格,不改变 API Key 的设置。本站使用的入口不适用区域数据驻留附加费。
账户扣费与历史分界
以调用记录时间为准:北京时间 2026-09-01 00:00 之前保留旧计费规则;从该时刻起使用新规则。历史 Token 和调用记录不修改,费用统计、导出与账户余额同步重算。
账户额度固定为 $300。剩余额度 = $300 − 上次重置之后的累计调用费用,系统自动更新。服务主窗口恢复至 100% 时自动重置账户额度,管理员也可手动重置;重置前的历史费用仍保留,但不再扣减当前额度。返回账户门户。
免费与尚无法核算的项目
codex-auto-review 从上述分界时刻起免费。Spark 等未公布官方 API 单价的模型保留本站原费率,不作为官方定价展示。图片模型暂保留原计费方式:历史记录缺少文本与图片 Token 拆分,无法据此精确补算官方图像费用。
本表为模型 Token 费用。官方托管工具调用等单独收费项目只有具备对应使用记录时才能核算,不能将此表视为包含所有工具费用的账单。