GPT-5.6 Sol进入极速运行阶段,单秒生成量突破750个token

OpenAI近日展示了其新一代模型GPT-5.6 Sol的超高速运行能力,系统在特定模式下可实现每秒高达750个token的输出速率,相较此前版本性能跃升14倍,显著优化了响应效率。

高性能算力由Cerebras芯片架构驱动,合作规模达百亿级

此次提速依赖于Cerebras提供的专用硬件支持,双方已于今年初达成一项价值100亿美元的战略合作协议,标志着大规模模型推理基础设施建设进入新阶段。

服务范围暂限于高阶API接入客户,尚未全面开放

尽管技术表现亮眼,该高速模式目前仍仅通过OpenAI API向少数经过筛选的企业级客户提供,未向公众或普通开发者全面推广。