预览Ultrafast模式:GPT-5.6 Sol速度提升达14倍
摘要
OpenAI预览基于Cerebras的API服务Ultrafast模式,使GPT-5.6 Sol运行速度提升14倍,输出速度可达每秒750 tokens。
核心要点
- OpenAI推出名为Ultrafast的新API服务层
- 该服务运行GPT-5.6 Sol模型
- 速度提升最高达14倍
- 由Cerebras提供底层算力支持
- 输出速度高达每秒750个token
原文佐证
- Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster.
- Powered by Cerebras, it delivers up to 750 output tokens per second.
AI 洞察
OpenAI与Cerebras的合作表明推理速度成为竞争关键,超高吞吐可能推动实时交互应用普及。但依赖外部算力也意味着供应链进一步集中,未来可能影响成本与自主可控。