OpenAI预览GPT-5.6 Sol每秒750个token的超高速模式

OpenAI推出了GPT-5.6 Sol超高速模式的有限预览,称这一新层级的输出速度最高可达该模型标准版的14倍,输出速度可达到每秒750个token,而基线约为每秒53个token。该服务于8月13日宣布,最初通过OpenAI API向部分客户开放,并计划随着算力容量扩张逐步扩大访问范围。该服务建立在OpenAI现有快速模式基础之上,后者可将GPT-5.6 Sol提速最高2.5倍,但超高速模式被定位为一个独立层级,由与Cerebras的合作及其晶圆级芯片架构提供支持。OpenAI和Cerebras表示,处于超高速模式下的GPT-5.6 Sol以11小时11分钟完成了包含2,500道题的基准测试Humanity’s Last Exam,而Anthropic的Claude Fable 5耗时为78小时27分钟。OpenAI还表示,超高速模式在不降低质量的情况下,使GDP-Val的端到端速度提升了5.6倍。两家公司表示,该模型运行速度约为Claude Fable 5的11倍,在快速模式下约为Opus 4.8的5倍。早期用户包括Jane Street、Basis、Rogo和Podium。OpenAI强调,其应用场景涵盖事件响应、金融研究、安全运营、语音AI、电子商务和研究工作流,在这些场景中,更低的延迟可实质性改变模型的使用方式。

本网站上的信息是使用AI生成的,我们无法保证其准确性。 请仅作为参考信息使用。