OpenAI推出Ultrafast极速模式:GPT-5.6 Sol速度提升14倍,每秒生成750 Tokens
OpenAI推出Ultrafast极速模式:GPT-5.6 Sol速度提升14倍,每秒生成750 Tokens
OpenAI发布Ultrafast新服务层级,由Cerebras提供支持,GPT-5.6 Sol运行速度最高提升至14倍,每秒可生成750个输出Tokens,面向实时响应场景。
8月13日消息,OpenAI今日公布Ultrafast模式预览版,这是OpenAI API的全新服务层级,可让GPT-5.6 Sol的运行速度最高提升至标准处理模式的14倍。该服务由Cerebras提供技术支持,每秒最多可生成750个输出Tokens。
技术突破与场景价值
Ultrafast标志着AI推理速度的新里程碑,首次让前沿智能模型实现实时级响应速度,无需在智能水平上妥协。OpenAI表示,过去要获得实时速度通常意味着选择更小或更专用的模型,而Ultrafast开辟了新方向:每秒完成更多有用工作。
重点应用场景
- 故障响应与可靠性:关键系统故障时,实时分析应用日志、代码变更和工程师报告,在故障持续期间快速定位问题并协助准备修复方案
- 金融研究与安全:实时分析市场信号、评估交易、识别可疑活动,在市场条件变化过程中快速响应
- 客户支持与语音交互:实时解决复杂客户问题,即使答案需要多步骤或多系统查询也不打断对话
- 商务场景:在购物者决策过程中实时回答产品问题、查询库存、个性化推荐、解决结账问题
- 实时研究与实验:将原本需要通宵运行的研究转化为交互式工作会话,支持团队快速测试想法、查看结果、调整方法
合作伙伴反馈
Jane Street、Podium、Basis、Rogo等首批测试客户已在编码、商务、金融研究、支持等场景验证了Ultrafast的价值。目前该模式处于有限预览阶段,企业可申请获取更新通知。