
OpenAI 日前面向企业推出 GPT-5.6 Sol UltraFast 超快模式预览,该模式下模型运行速度将提升最高 14 倍,最高每秒可以生成 750tokens。不过超快模式需要 OpenAI 根据企业场景进行审批,企业可以提交申请但是否可以获得批准取决于 OpenAI 审核。
适合需要实时响应的工作负载:
OpenAI 称超快模式由 Cerebras 提供支持,目前仅适用于 GPT-5.6 Sol 模型,在开启超快模式后模型的生成速度最高每秒 750tokens,相当于标准模式的 14 倍。
当然并非所有工作负载都需要超快模式,OpenAI 称该模式专门为需要实时或接近生产环境的工作负载设计,例如实时语音、客户支持、商务、开发智能体、金融研究和安全研究等场景。
在预览阶段 Cerebras 提供的资源有限,因此企业提交申请后,OpenAI 将根据客户提供的使用场景决定是否批准使用超快模式,OpenAI 也会根据工作负载逐步提高覆盖范围,未来可能超快模式会支持更多企业通过 API 调用。
以上就是“GPT-5.6 Sol超快模式(UltraFast)面向企业预览 运行速度提升14倍 每秒最多750tokens”的详细内容,想要了解更多Python教程欢迎持续关注编程学习网。
扫码二维码 获取免费视频学习资料

- 本文固定链接: http://www.phpxs.com/post/14531/
- 转载请注明:转载必须在正文中标注并保留原文链接
- 扫码: 扫上方二维码获取免费视频资料
查 看2022高级编程视频教程免费获取