快讯 23:53Shopify 弃用 React Native,AI 智能体重写 Shop 应用回归原生开发23:45Hugging Face CEO 谈被 NVIDIA 收购:借力招人,以十年周期押注开源 AI23:30NVIDIA 开源表格基础模型 Kumo Tabular,四项基准测试登顶 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 09-30 01:43 约 1 分钟读完

OpenAI 发布 GPT-6 Astra Ultrafast,词元生成速度最高提升至 8 倍

摘要

OpenAI 在 2026 年开发者日推出 Ultrafast 服务层级,GPT-6 Astra 在 Codex 中词元生成速度最高达 8 倍,API 调用最高 6 倍。API 输出定价为短上下文每百万词元 300 美元,长上下文 450 美元。

在 2026 年 OpenAI 开发者日活动上,OpenAI 正式发布名为 Ultrafast 的全新服务层级。该层级针对 GPT-6 Astra 模型进行了推理加速优化,官方数据显示,在 Codex 环境中词元生成速度最高可达到此前的 8 倍,通过 API 调用时最高可实现 6 倍生成速度提升。

定价方面,GPT-6 Astra 在 Ultrafast 层级下采用按上下文长度区分的计费方式。短上下文(输入低于 272K 词元)中,输入价格为每百万词元 60 美元,缓存输入为 6 美元,缓存写入为 75 美元,输出为 300 美元。当输入超过 272K 词元进入长上下文区间后,各项价格翻倍或接近翻倍:输入 120 美元,缓存输入 12 美元,缓存写入 150 美元,输出 450 美元。

需要指出的是,缓存写入指首次将输入内容存入提示词缓存时产生的费用,而缓存输入则是后续请求复用已缓存内容时的计费项,后者价格显著低于前者。这一计费结构延续了 OpenAI 对缓存复用的价格激励逻辑。

Ultrafast 层级的推出,意味着 OpenAI 在模型推理效率上给出了新的工程化方案。对于依赖 Codex 进行高频代码生成、或通过 API 构建实时交互应用的开发者而言,生成速度的量级提升可能直接改变产品体验与成本结构。不过,输出价格仍处于较高水平,实际采用时需结合具体场景评估速度收益与费用支出的平衡。

OpenAIGPT-6 AstraUltrafastAPI 定价
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
54
企业落地案例
8
完整版提示词