OpenAI 发布 Jalapeño:首款自研芯片直指大模型推理成本
OpenAI 与 Broadcom 发布首款自研推理处理器 Jalapeño。它不是把通用加速器简单改造成 AI 芯片,而是围绕大语言模型的 kernel、内存移动、网络与服务模式从零设计。工程样片已在目标频率和功耗下运行包括 GPT-5.3-Codex-Spark 在内的工作负载,早期测试显示每瓦性能显著优于现有先进方案,详细技术报告将在之后公布。
更值得关注的是研发方式:OpenAI 称项目从设计到流片只用了九个月,并让自家模型参与设计与优化。首代产品计划在 2026 年底开始部署,后续将与 Broadcom、Celestica 及数据中心伙伴扩展到吉瓦级。对用户而言,真正的落点不是多一款芯片,而是 ChatGPT、Codex 和 API 能否获得更低延迟、更高可靠性与更可控的推理成本。
来源:OpenAI · TechCrunch