OpenAI在Hot Chips大会上首次公开了其自研推理芯片Jalapeño的实测数据。这款与博通联合开发的芯片,在GPT-OSS 120B、DeepSeek R1等多个主流模型的推理任务中,单位功耗下的算力输出达到了英伟达当前旗舰GB300的1.5到1.9倍。同时,从请求发起到输出完成的整体响应时间缩短至GB300平台的28%到59%。芯片设计功耗控制在700瓦,定位面向推理场景而非训练负载。
按照既定节奏,该芯片将于今年年底启动小规模部署,2027年进入规模化应用阶段。更令人关注的是,其第二代产品已完成深度研发即将流片,第三代也进入了概念设计阶段,显示出OpenAI在芯片自研路线上的长期布局。
【AICOR 点评】当模型厂商开始自建芯片,意味着AI产业正从"堆卡竞赛"走向"效率竞赛"。对中大型企业而言,推理成本有望在未来两年内显著下降,这将为AI应用的规模化落地扫除最后一道经济性障碍。
版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。
如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。