OpenAI 与 Broadcom 发布 Jalapeño 推理芯片,瞄准大模型推理效率

OpenAI 与 Broadcom 发布 Jalapeño 推理芯片,瞄准大模型推理效率

OpenAI 在 2026 年 6 月 24 日宣布与 Broadcom 联合发布 Jalapeño,这是 OpenAI 首个面向大模型推理场景设计的 Intelligence Processor。 这条消息值得 AI 工具用户关注:推理芯片的效率、成本和供给能力,最终会影响 ChatGPT、Codex、API 等产品的响应速度、稳定性和使用成本。

AI盒子导航
68 0
OpenAI 与 Broadcom 发布 Jalapeño 推理芯片,瞄准大模型推理效率

事件概览

OpenAI 官方在 2026 年 6 月 24 日发布消息,宣布与 Broadcom 联合推出 Jalapeño。官方称这是 OpenAI 首个 Intelligence Processor,定位为围绕大模型推理需求设计的加速器,也是双方多代计算平台合作的第一步。

为什么这件事重要

对普通用户来说,推理就是模型真正回答问题、运行工具和执行任务的阶段。推理基础设施变强,可能带来更快的 ChatGPT 响应、更稳定的 Codex 任务、更高的 API 承载能力,以及未来更可控的使用成本。

关键技术方向

OpenAI 表示,Jalapeño 不是把通用 AI 加速器简单改造,而是从大模型推理工作负载出发设计。官方提到它会围绕计算、内存、网络和数据移动进行优化,早期测试显示其每瓦性能有望优于当前先进方案;完整性能报告仍需等待后续公布。

合作与部署节奏

这套平台由 OpenAI、Broadcom 和 Celestica 等伙伴共同推进:OpenAI 负责芯片架构和工作负载理解,Broadcom 提供芯片实现和网络技术,Celestica 参与板卡、机架和系统集成。官方说法是,这是一条多代平台路线,计划从 2026 年底开始部署并在之后几年继续扩展。

对 AI 工具用户的影响

短期看,Jalapeño 还处在样品和测试阶段,用户不会立刻感受到价格或速度变化。中长期看,如果这类专用推理芯片规模化落地,AI 产品可能更容易获得稳定算力,工具调用、长任务、Agent 工作流和实时对话体验都有机会受益。

相关地址

官方来源:OpenAI - OpenAI and Broadcom unveil LLM-optimized inference chip https://openai.com/index/openai-broadcom-jalapeno-inference-chip/

评论

0 条评论

暂无评论,快来抢沙发~