Cerebras 为 OpenAI GPT-5.6 Sol 提供 Ultrafast 模式,速度提升 14 倍达 750 tokens/秒
Cerebras 8 月 13 日宣布为 OpenAI GPT-5.6 Sol 提供 Ultrafast 模式,速度提升 14 倍达 750 output tokens/秒,无质量妥协。该模式 initially 向部分 API 客户开放,定价未公布,ChatGPT/Codex 暂不支持。OpenAI 官方、Cerebras 投资者关系、finviz、explainx.ai 等多源确认。
Cerebras 为 OpenAI GPT-5.6 Sol 提供 Ultrafast 模式
事件与背景
2026 年 8 月 13 日,Cerebras(NASDAQ: CBRS)宣布为 OpenAI GPT-5.6 Sol 提供 Ultrafast 模式,速度提升 14 倍达 750 output tokens/秒,无质量妥协。这是 OpenAI API 新服务层级,通过 Cerebras 晶圆级芯片实现超低延迟推理。
核心信息
| 指标 | 数据 |
|---|---|
| 速度提升 | 14 倍 |
| 输出速度 | 750 tokens/秒 |
| 质量影响 | 无妥协 |
| 可用性 | API-only,部分客户 preview |
| 定价 | 未公布 |
| ChatGPT/Codex | 暂不支持 |
关键发现
- 超低延迟:750 tokens/秒是目前公开的最快推理速度之一
- 无质量妥协:Cerebras 声称无质量损失
- API-only:仅面向部分 API 客户,ChatGPT/Codex 暂不支持
- 定价未公布:反映仍在测试阶段
战略意义
OpenAI 通过 Cerebras 晶圆级芯片实现超低延迟推理,适合时间敏感的 critical 应用。此举显示 OpenAI 在推理基础设施上的多元化布局,不完全依赖 NVIDIA。Cerebras 作为 AI 芯片初创,通过与 OpenAI 合作获得重要商业验证。
行业影响
- 推动 AI 推理速度竞争
- 影响 AI 芯片市场格局(NVIDIA vs Cerebras)
- 为 critical 应用提供超低延迟选项
- 反映 OpenAI 推理基础设施多元化战略
后续观察
- Ultrafast 模式定价与扩展计划
- Cerebras 芯片对推理成本的实际影响
- OpenAI 与 Cerebras 合作深度
- 其他模型厂商是否跟进类似超低延迟服务
- ChatGPT/Codex 是否会支持 Ultrafast
AI Master 解读
核心事件
Cerebras 为 OpenAI GPT-5.6 Sol 提供 Ultrafast 模式,速度提升 14 倍达 750 tokens/秒。
行业影响
为什么重要: 这是 OpenAI API 新服务层级,通过 Cerebras 晶圆级芯片实现超低延迟推理。750 tokens/秒是目前公开的最快推理速度之一,适合时间敏感的 critical 应用。定价未公布反映仍在测试阶段。ChatGPT/Codex 暂不支持显示这是 API-only 功能。
影响分析:
| 维度 | 影响 |
|---|---|
| 推理速度 | 14 倍提升,750 tokens/秒 |
| 质量 | 无妥协(no quality compromise) |
| 可用性 | API-only,部分客户 preview |
| 定价 | 未公布 |
AI Master 建议
关注 Ultrafast 模式定价与扩展计划;评估 Cerebras 芯片对推理成本的影响;跟踪 OpenAI 与 Cerebras 合作深度;关注其他模型厂商是否跟进类似超低延迟服务。 **来源:** OpenAI 官方、Cerebras 投资者关系、finviz、explainx.ai **链接:** https://openai.com/index/previewing-ultrafast/
