(网经社讯)8月14日,OpenAI宣布以预览形式推出GPT-5.6 Sol的Ultrafast(超高速)模式。该模式由AI芯片厂商Cerebras提供算力支持,输出速度最高可达每秒750个token,较标准模式提升约14倍。
据网经社AI台(AI.100EC.CN)获悉,此前,用户若需更快的模型响应速度,通常需要牺牲模型能力,选择更小或更专用的模型。Ultrafast模式在不降低模型智能水平的前提下实现了速度跃升,让“每秒完成更多有价值工作”成为新的方向。Cerebras晶圆级引擎(Wafer-Scale Engine)架构将44GB的SRAM集成于单颗晶圆级芯片上,模型权重直接驻留在片上,消除了传统GPU推理中内存带宽的瓶颈。
据Artificial Analysis报告,Ultrafast模式运行速度是Claude Opus 4.8快速模式的5倍,是Claude Fable 5的11倍。在“人类终极考试”(Humanity's Last Exam)基准测试中,GPT-5.6 Sol Ultrafast以11小时11分钟完成全部2500道题目,而Claude Fable 5耗时78小时27分钟。在衡量经济价值知识工作的GDP-Val基准上,Ultrafast实现了5.6倍的端到端速度提升。
早期应用场景包括:事故响应与可靠性分析、金融研究与安全分析、客服与语音交互、电商场景中的商品问答与库存查询,以及实时研究和实验。该模式当前处于有限预览阶段,仅向一小批客户开放。OpenAI表示将根据客户的工作负载契合度及算力可用性评估访问权限。


































.png)



