OpenAI日前面向企业推出GPT-5.6SolUltraFast超快模式预览,该模式下模型运行速度将提升最高14倍,最高每秒可以生成750tokens。不过超快模式需要OpenAI根据企业场景进行审批,企业可以提交申请但是否可以获得批准取决于OpenAI审核。
适合需要实时响应的工作负载:
OpenAI称超快模式由Cerebras提供支持,目前仅适用于GPT-5.6Sol模型,在开启超快模式后模型的生成速度最高每秒750tokens,相当于标准模式的14倍。
当然并非所有工作负载都需要超快模式,OpenAI称该模式专门为需要实时或接近生产环境的工作负载设计,例如实时语音、客户支持、商务、开发智能体、金融研究和安全研究等场景。
在预览阶段Cerebras提供的资源有限,因此企业提交申请后,OpenAI将根据客户提供的使用场景决定是否批准使用超快模式,OpenAI也会根据工作负载逐步提高覆盖范围,未来可能超快模式会支持更多企业通过API调用。
有兴趣的企业客户可以点击这里提交申请:https://openai.com/form/ultrafast/

相关文章

头条焦点
精彩导读
关注我们
【查看完整讨论话题】 | 【用户登录】 | 【用户注册】