OpenAI于2026年8月13日宣布,GPT-5.6 Sol的Ultrafast模式进入有限预览阶段。该模式由Cerebras硬件支持,输出速度最高达到每秒750个token,较标准处理快14倍。此服务首先通过OpenAI API提供。
速度提升的实际应用场景
预览期间,部分客户已在编码、商业、金融研究和支持类交互应用中测试该模式。Jane Street AI Assistants负责人John Crepezzi表示,Cerebras带来的速度提升令人印象深刻,它让开发者能以更专注的方式与模型协作。OpenAI内部则将Ultrafast用于事件响应流程,包括读取日志、分析追踪和准备修复方案。
更快推理缩短了从观察信号到测试假设再到选择下一步行动的时间。
研究团队反馈显示,以往需隔夜运行的实验,现在可在工作日内完成多次迭代。
硬件合作与技术实现
Ultrafast模式依赖Cerebras提供的超低延迟推理能力。OpenAI强调,此前模型速度与能力往往难以兼得,用户若追求更快输出,通常需转向更小模型。Ultrafast试图打破这一权衡,让每秒完成更多有价值工作成为可能。
早期应用包括事故响应、金融安全分析、语音交互以及电商库存查询。所有这些场景均要求模型响应速度接近用户操作节奏。
访问限制与扩展计划
目前该模式仅向一小批精选客户开放。OpenAI表示,将根据容量增长逐步扩大访问范围。社区论坛讨论显示,部分用户关注API额度消耗速度,担心高速度可能更快耗尽周使用限额。
产业层面的潜在影响
速度成为新竞争维度后,低延迟代理任务的市场格局可能发生变化。开发者期待该模式落地后,能支持更流畅的实时应用。OpenAI内部使用案例表明,推理加速直接缩短了从信号观察到行动选择的时间间隔。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接