OpenAI 发布 GPT-6 Astra Ultrafast,词元生成速度最高提升至 8 倍
OpenAI 在 2026 年开发者日推出 Ultrafast 服务层级,GPT-6 Astra 在 Codex 中词元生成速度最高达 8 倍,API 调用最高 6 倍。API 输出定价为短上下文每百万词元 300 美元,长上下文 450 美元。
在 2026 年 OpenAI 开发者日活动上,OpenAI 正式发布名为 Ultrafast 的全新服务层级。该层级针对 GPT-6 Astra 模型进行了推理加速优化,官方数据显示,在 Codex 环境中词元生成速度最高可达到此前的 8 倍,通过 API 调用时最高可实现 6 倍生成速度提升。
定价方面,GPT-6 Astra 在 Ultrafast 层级下采用按上下文长度区分的计费方式。短上下文(输入低于 272K 词元)中,输入价格为每百万词元 60 美元,缓存输入为 6 美元,缓存写入为 75 美元,输出为 300 美元。当输入超过 272K 词元进入长上下文区间后,各项价格翻倍或接近翻倍:输入 120 美元,缓存输入 12 美元,缓存写入 150 美元,输出 450 美元。
需要指出的是,缓存写入指首次将输入内容存入提示词缓存时产生的费用,而缓存输入则是后续请求复用已缓存内容时的计费项,后者价格显著低于前者。这一计费结构延续了 OpenAI 对缓存复用的价格激励逻辑。
Ultrafast 层级的推出,意味着 OpenAI 在模型推理效率上给出了新的工程化方案。对于依赖 Codex 进行高频代码生成、或通过 API 构建实时交互应用的开发者而言,生成速度的量级提升可能直接改变产品体验与成本结构。不过,输出价格仍处于较高水平,实际采用时需结合具体场景评估速度收益与费用支出的平衡。