摘要由 AI 生成
2026 年 8 月 27 日,OpenAI 在 Hot Chips 37 会议上正式推出自研推理芯片 Jalapeño。测试数据显示,该芯片在真实工作负载中相比 NVIDIA GB200/GB300 系统实现了材料级效率与延迟提升:峰值吞吐量每瓦特完成工作量提升 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍,高交互工作负载性能提升 2.1 至 4.1 倍。芯片额定功耗为 700W,测试中控制在 550W 以下。OpenAI 计划于年底前将 Jalapeño 部署至自有基础设施,Gen 2 版本已深入开发,Gen 3 正在研发中。此外,通过 GPT-Astra 与 Codex 优化底层内核,部分注意力机制及 MoE 块运行速度较现有专家代码快 1.5 至 1.8 倍。
关键实体KEY ENTITIES
AppleCS-5CerebrasGroqJalapeñoM6NVIDIAOpenAI
事件框架EVENT FRAME
产品发布
OpenAI
Jalapeño
发布自研推理芯片,能效优于 GB200
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
信号强度SIGNALS
关键词热度
- OpenAI1
- Jalapeño1
- Cerebras1
- CS-51
- Groq1
- Apple1
- M61
- NVIDIA1
全部报道(1)SOURCES
↗
OpenAI 在 37 届 Hot Chips 会议上发布其自研推理芯片 Jalapeño,宣称相比 NVIDIA GB200/GB300 系统在真实工作负载上实现材料级效率与延迟提升。测试数据显示,Jalapeño 峰值吞吐量每瓦特完成工作量为 1.5–1.9 倍,端到端延迟降低 1.7–3.6 倍,高交互工作负载性能提升 2.1–4.1 倍;芯片额定功耗为 700W,测试中保持在 550W 以下。OpenAI 计划于年底前将其部署至自有基础设施,Gen 2 已深入开发,Gen 3 正在进行中。此外,GPT-Astra + Codex 协助优化底层内核,使部分注意力及 MoE 块运行速度比现有专家编写的代码快 1.5–1.8 倍。