在2026年OpenAI开发者日活动上,OpenAI宣布推出名为Ultrafast的全新服务层级,旨在为高时效性场景提供更快的词元生成能力。该服务在Codex中可实现最高8倍的词元生成速度,在API调用场景下最高可达6倍生成速度。目前该服务已开放API调用,Pro 500订阅用户和企业用户可在ChatGPT Work和Codex中体验。
根据官方公布的定价信息,GPT-6 Astra Ultrafast在短上下文(输入小于272K词元)场景下,输入价格为每百万词元60美元,缓存输入为每百万词元6美元,缓存写入为每百万词元75美元,输出为每百万词元300美元。长上下文(输入大于272K词元)场景下,各项价格相应翻倍或上调,其中输出价格达到每百万词元450美元。缓存写入指首次将输入内容保存至提示词缓存时产生的费用,缓存输入则指后续请求重复使用已缓存内容时的计费方式,价格显著低于标准输入。
OpenAI官方数据显示,GPT-6 Astra Ultrafast在Codex中可实现每秒300个词元的生成速度。官方同时表示,后续将跟进推出GPT-6.1 Sol Ultrafast。从产品定位看,Ultrafast试图解决大模型在实时场景中的响应瓶颈。此前若要实现接近实时的速度,通常需要换用参数更小或专用性更强的模型,而Ultrafast的目标是在保持GPT-5.6 Sol能力水平的前提下,提升单位时间内的有效工作量。
该服务面向事件响应、实时客服、交易与市场快讯生成、交互式编码等对延迟敏感的场景。对于企业用户而言,Ultrafast的推出意味着在不牺牲模型能力的前提下,可将大模型嵌入对响应速度要求较高的生产流程中,但相应的高昂输出定价也意味着成本控制仍是落地时需要考虑的因素。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。