Intel Xeon 7 Diamond Rapids 架构详解
2026 年 8 月 26 日,Intel 在 Hot Chips 2026 发布。
事件背景
Intel 在 Hot Chips 2026 会议详解了下一代 Xeon 7 Diamond Rapids 服务器 CPU 平台。这是 Intel 首次在服务器 CPU 中采用 chiplet 架构和 18A 工艺,标志着 Intel Foundry 战略的关键验证点。
关键事实
| 项目 | 详情 |
|---|---|
| 核心数 | 最高 256 核(22 chiplet 封装) |
| 核心计算 die | 16 个,采用 18A-P 工艺 |
| CBB base die | 4 个 Intel-3-T |
| Fabric hub | 2 个 Intel-3 |
| AI 加速 | FP8 AMX、完整 AVX 10.2 |
| 内存 | 16 通道 DDR5-8000(12,800 MT/s with MRDIMMs) |
| I/O | 128 条 PCIe 6.0/CXL 3 通道 |
| 超线程 | 完全取消 |
| 发布计划 | 原定 2026,推迟至 2027 |
技术机制
Diamond Rapids 采用 disaggregated chiplet 架构:
- 核心计算 die(CCD):16 个 18A-P 工艺的核心计算芯片,每个包含 16 个核心
- CBB base die:4 个 Intel-3-T 工艺的基础芯片,提供缓存互连
- Fabric hub:2 个 Intel-3 工艺的互连芯片,管理 chiplet 间通信
FP8 AMX(Advanced Matrix Extensions)是 Intel 首次在服务器 CPU 中支持 8 位浮点矩阵运算,使 CPU 可直接运行量化 AI 模型,无需 GPU。
取消超线程(Hyper-Threading)是重大架构决策。Intel 认为在 HPC 和 AI 推理场景,单线程性能和功耗效率比逻辑核心数更重要。
影响分析
| 维度 | 影响 |
|---|---|
| AI 推理 | FP8 AMX 使 CPU 可直接运行 Llama、Qwen 等开源模型的量化版本 |
| HPC | 取消超线程专注单线程性能,适合科学计算和仿真 |
| 内存带宽 | 16 通道 DDR5-8000 提供 12,800 MT/s,缓解大模型推理的内存瓶颈 |
| 竞争格局 | 直接对标 AMD EPYC Turin(Zen 5)和 NVIDIA Grace(Arm) |
| Intel Foundry | 18A-P 工艺的首次商用验证,影响 Intel 代工业务前景 |
风险边界与后续观察
- 发布延迟: 原定 2026 年发布已推迟至 2027,可能影响 Intel 数据中心市场份额
- 18A-P 良率: 18A 工艺的良率和量产进度是未知数
- FP8 AMX 性能: 实际推理性能需要第三方验证,与 GPU 的性价比对比待观察
- 生态支持: 软件生态对 FP8 AMX 的优化程度影响实际可用性
AI Master 解读
核心事件
Intel 在 Hot Chips 2026 发布 Xeon 7 Diamond Rapids 详细架构。
行业影响
为什么重要: 这是 Intel 首次在服务器 CPU 中集成 FP8 AMX 支持,直接对标 AMD EPYC 和 NVIDIA Grace CPU。256 核规模和取消超线程的决定表明 Intel 将 HPC 和 AI 推理置于通用计算之上。18A-P 工艺的首次商用是 Intel Foundry 的关键验证点。
影响分析:
| 维度 | 影响 |
|---|---|
| AI 推理 | FP8 AMX 使 CPU 可直接运行量化推理,减少对 GPU 依赖 |
| HPC | 取消超线程专注单线程性能,适合科学计算 |
| 内存带宽 | 16 通道 DDR5-8000 提供 12,800 MT/s,缓解内存瓶颈 |
| 竞争格局 | 直接对标 AMD EPYC Turin 和 NVIDIA Grace |
AI Master 建议
关注 18A-P 工艺的良率和量产进度。FP8 AMX 的实际推理性能需要第三方验证。延迟发布可能影响 Intel 在 2026 数据中心市场的份额。
