OpenAI 文档曝光 Ultrafast API 新进展,DevDay 前夕或扩大开放范围

OpenAI 此前已正式预览搭载 GPT-5.6 Sol 的 Ultrafast 模式,称其输出速度最高可达每秒 750 个 Token,相比 Standard 模式的推理速度最高可提升 14 倍。

据 X 平台博主 @imjustnewatai 爆料,OpenAI Platform 和 API 文档中已出现 Ultrafast API 的相关文档条目,这一动向被外界解读为该公司可能准备扩大 Ultrafast API 的开放范围。与此同时,OpenAI 正在为 Responses API Playground 准备全新的速度选项,用户可在 Standard、Fast 和 Ultrafast 三种处理速度之间进行选择,目前该功能仍处于隐藏状态。

Ultrafast 模式并非首次进入公众视野。OpenAI 此前已正式预览搭载 GPT-5.6 Sol 的 Ultrafast 模式,官方数据显示其输出速度最高可达每秒 750 个 Token,相比 Standard 模式的推理速度最高可提升 14 倍。不过截至目前,该模式仍仅向部分客户开放,尚未进入全面可用阶段。

从时间节点来看,Ultrafast 在 9 月 29 日举行的 DevDay 活动期间扩大开放范围具有较高可能性。DevDay 是 OpenAI 面向开发者群体的年度活动,历来承担着发布新模型、新工具和新 API 能力的功能。文档中提前出现相关条目,通常被视为产品即将正式开放的先行信号。

值得关注的是,OpenAI 已经推出 GPT-6 系列模型,涵盖 GPT-6 Sol 和 GPT-6 Astra 两个版本。新模型是否支持 Ultrafast 模式,目前尚无明确信息。爆料中亦未确认所有 GPT-6 系列模型是否会在发布时同步支持 Ultrafast。若 Ultrafast 能够覆盖 GPT-6 系列,意味着 OpenAI 在保持推理质量的同时,将高速推理能力扩展至其最新一代模型,这对开发者构建实时交互类应用具有直接影响。

从行业角度看,推理速度正在成为大模型 API 竞争的关键维度之一。过去一年,多家模型厂商相继推出低延迟推理方案,通过专用推理芯片、模型蒸馏、投机采样等技术手段压缩响应时间。OpenAI 的 Ultrafast 模式以最高 14 倍的推理速度提升作为卖点,若实现规模化开放,将进一步拉高企业级 AI 应用对响应延迟的预期基准。

对于依赖大模型 API 的企业客户而言,速度选项的分级设计也意味着成本与性能之间的权衡将更加精细化。Standard、Fast、Ultrafast 三档速度若对应不同定价,开发者可根据具体业务场景——如实时客服、代码补全、批量内容生成——灵活选择处理档位,从而在延迟敏感型任务和成本敏感型任务之间做出更合理的资源分配。

目前 OpenAI 官方尚未就 Ultrafast API 的开放计划发布正式声明。文档中出现相关条目是否意味着功能即将上线,以及 GPT-6 系列模型与 Ultrafast 的兼容性如何,仍有待 DevDay 期间或后续官方信息确认。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

赞 (0)
国内首部院线AI原生动画电影《三星堆:未来往事》定档10月23日
上一篇 2小时前
微软新版Outlook将上线发送前拼写检查,经典版继续获得Copilot更新
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部