OpenAI官方确认:Codex长上下文超272K不加价,缓存写入免费

围绕OpenAI Codex平台长上下文计费规则的争议有了官方结论。此前,OpenAI企业级Token定价体系对超过272K输入词元的长上下文设有额外计费乘数,但该规则是否同样适用于Codex平台,官方一直未给出明确说明,开发者社区对此议论纷纷,担心在Codex中处理大型代码库时会触发双倍计费。近日,OpenAI官方帮助中心更新了一篇关于GPT-6 Astra与Codex长上下文例外的说明文档,明确指出:在Codex中使用GPT-6 Astra模型时,输入词元超过272K不会产生额外的长上下文计费乘数;同时,Codex也不会对缓存写入收取费用。这一说明意味着开发者可以在Codex中放心处理超长上下文任务,例如大型代码仓库的分析与重构,而不必担心长上下文溢价推高成本。缓存写入免费则进一步降低了重复调用场景下的实际开销,对频繁进行多轮对话和代码迭代的工作流尤为有利。该说明发布在OpenAI官方企业级Token定价费率卡页面上,属于官方正式计费文档,具有一定权威性。不过,文档仅针对GPT-6 Astra模型作出例外说明,其他模型在Codex中是否同样豁免长上下文加价尚无明确表述,官方文档与实际账单扣费是否完全一致,仍有待开发者实际使用验证。

事件分析

长上下文计费是当前大模型定价体系中最易被忽视的成本项。272K阈值是超长上下文区间的分界线,超过后价格翻倍的设计初衷是抑制滥用,但该规则在API、ChatGPT订阅与Codex等不同入口之间如何套用,长期缺乏统一口径,此次官方文档的明确相当于填补了规则空白。从产业角度看,AI编程工具的竞争已从模型能力延伸至计费透明度。Claude Code、Cursor等竞品均在计费策略上持续调整,OpenAI主动澄清不加价与缓存免费,实质是降低重度用户的成本预期门槛,争夺大型代码库场景下的开发者心智。后续值得关注的走向有三:一是其他模型能否获得同等豁免;二是实际扣费数据与文档的一致性验证;三是缓存免费策略是否扩展至API侧。若账单与文档出现偏差,相关争议可能再度发酵。

核心观点:计费规则模糊是AI编程工具的信任黑洞,官方文档补位只是第一步,账单一致性才是留住重度开发者的关键。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册