預覽超快速模式,一項新的 OpenAI API 服務層級,可讓 GPT-5.6 Sol 的速度提升最高 14 倍。由 Cerebras 提供支援,每秒可輸出高達 750 個 token。
ai 70
預覽超快速模式:GPT-5.6 Sol 速度提升最高 14 倍
OpenAI 推出新的 API 服務層級「超快速模式」,採用 Cerebras 技術,讓 GPT-5.6 Sol 的處理速度最高可提升 14 倍,達到每秒 750 個輸出 token 的效能。這項更新旨在大幅提升模型回應速度,為開發者和使用者帶來更流暢的體驗。
值得注意顯著提升模型速度,對 AI 應用開發者有直接且重大的影響。
原文來源: OpenAI Blog