OpenAI 预览 GPT-5.6 Sol Ultrafast 模式:推理速度提升至 14 倍
OpenAI 宣布在 API 中推出全新服务层 Ultrafast 预览版,依托与 Cerebras 的合作,将旗舰模型 GPT-5.6 Sol 的输出速度提升至最高每秒 750 个 Token,处理速度达到标准模式的 14 倍。该技术突破旨在解决高智力模型在实时高时效场景中的性能瓶颈,使前沿 AI 能够直接嵌入对响应延迟要求极高的核心业务流程。
该模式重点面向系统故障响应、金融市场分析、实时语音客服及高频研究实验等场景。OpenAI 内部团队已将其用于日志分析与实时修复,并将传统需隔夜运行的研究实验缩短为单日内的多轮交互。服务目前已面向部分企业客户开放测试,后续将逐步扩大接入范围。







