OpenAI加速扩大Ultrafast API开放范围:每秒750 token、推理快14倍
talkingdev • 2026-09-28
2418 views
OpenAI正在为旗下Ultrafast API模式的更大规模开放做准备。根据OpenAI Platform和API文档中出现的相关说明,这一高速推理模式已开始向更广泛用户群释放信号。Ultrafast API最早随GPT-5.6 Sol预览亮相,官方称其输出速度可达每秒750个token,推理速度最高比标准模式快14倍。该模式由Cerebras提供底层算力支持,目标是显著降低生成延迟,适合实时对话、代码补全、智能体工作流等对响应速度要求较高的场景。目前该API仍仅向部分客户开放,但文档层面的更新表明OpenAI正推进更广泛的发布,预计将在OpenAI DevDay之后逐步铺开。对开发者而言,这意味着未来有望以更低延迟和更高吞吐量调用前沿模型能力,进一步压缩交互等待时间,并可能改变实时AI应用的成本与体验平衡。
核心要点
- Ultrafast API模式正出现在OpenAI Platform和API文档中,预示更大范围推广
- 该模式官方宣称每秒输出750个token,推理速度比Standard最高快14倍
- Ultrafast API由Cerebras提供算力,目前仍仅限部分客户使用