💬 观点Latent Space
[AINews] Hot Chips: OpenAI’s Jalapeño, Cerebras CS-5, — OpenAI自研芯片Jalapeño性能超越Blackwell,推理栈与智能体工
OpenAI自研芯片Jalapeño性能超越Blackwell,推理栈与智能体工具链迎来关键转折。
2026-08-27原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
OpenAI自研推理芯片Jalapeño
首代自研推理芯片,能效与延迟全面超越NVIDIA Blackwell
- 峰值吞吐每瓦1.5–1.9倍于GB200/GB300
- 端到端延迟降低1.7–3.6倍
- 额定700W,实测≤550W
⚙️ 流程拆解
STEP 1发布Jalapeño基准
STEP 2GPT-Astra优化kernel
STEP 3年底部署自有设施
STEP 4Gen 2/3持续迭代
- OpenAI发布自研推理芯片Jalapeño,宣称能效和延迟优于NVIDIA GB200/GB300,实测功耗低于额定值。这标志着前沿实验室在推理经济性上不再完全依赖NVIDIA,但封装和代工产能仍是瓶颈。
- 智能体性能越来越取决于外围系统而非模型本身:微软AutoSaddler通过离线补丁提升GAIA2等基准分数,而“无中性基准”研究显示更换harness对分数影响大于换模型。这推动harness标准化和评估工程产品化。
- 本地优先智能体兴起:Perplexity发布便携式计算机,全本地运行;Apple和Ollama等工具链也在成熟。这预示个人计算将转向持续运行的本地代理,但成本仍是争议点。
原文:[AINews] Hot Chips: OpenAI’s Jalapeño, Cerebras CS-5, Groq 3 LPX, Apple M6 · 作者 Latent Space
🕸 顺着图谱继续读
- Codex for every role, tool, and workflow — OpenAI 展示 Codex 如何赋能分析师、营销、设计等多角色工作流,值得开2026-06-02 · 共同涉及 OpenAI、Codex、NVIDIA
- Jalapeño’s first results show industry-leading speed — OpenAI自研推理芯片Jalapeño首秀,主打速度与能效。2026-08-25 · 共同涉及 OpenAI、Jalapeño
- [AINews] It's Meta-Harness Summer — AI 基础设施正从模型竞赛转向“元马具”架构之争,本文梳理了芯片、代理 UX 与2026-06-25 · 共同涉及 OpenAI、Jalapeño
- OpenAI and Broadcom unveil LLM-optimized inference chip — OpenAI与Broadcom合作推出专为大模型推理优化的芯片Jalapeño。2026-06-24 · 共同涉及 OpenAI、Jalapeño