OpenAI 发布了名为 Ultrafast 的新模式,主打更高的模型响应速度。公司称,这一模式可让 GPT 5.6 Sol 以标准处理速度的 14 倍运行,输出速度最高可达每秒 750 个 token,目前先以预览形式向少量客户开放。
这一更新瞄准的是企业对实时 AI 处理的需求。OpenAI 表示,过去如果想获得更接近实时的响应,通常需要改用更小的模型,或选择针对特定任务优化的系统。Ultrafast 的方向则是,在不单纯依赖小模型的情况下,提高单位时间内可完成的有效工作量。
输出速度提升
按照 OpenAI 的说法,Ultrafast 的核心卖点是显著压缩生成等待时间。
- 最高输出速度可达每秒 750 个 token
- 处理速度约为标准模式的 14 倍
- 当前版本仍处于预览阶段
TechCrunch 提到,Anthropic 等竞争对手此前也推出过加速模式。以 Claude 为例,其产品同样提供快速模式,但 OpenAI 此次公布的速度指标更高。
面向企业工作流
OpenAI 将 Ultrafast 的应用场景指向多类企业任务,重点包括事件响应、客户服务与支持、金融市场分析以及电商业务等。这类场景通常对延迟更敏感,模型响应时间会直接影响人工协作效率和自动化流程表现。
从产品定位看,Ultrafast 并不是单独的新模型,而是围绕 GPT 5.6 Sol 提供的一种高速度运行方式。对企业客户而言,这意味着在保留较强模型能力的同时,尝试把 AI 更直接地嵌入实时业务流程。
由 Cerebras 提供支持
OpenAI 表示,Ultrafast 由其与芯片公司 Cerebras 的合作提供支持。首批预览资格目前仅开放给一小部分客户,后续会随着算力容量提升逐步扩大访问范围。
这也显示出,大模型竞争正在从参数和能力比拼,延伸到响应速度、部署效率和底层算力协同。对于面向企业市场的 AI 产品来说,速度正在成为与模型质量并列的关键指标。











