A5站长网8月30日消息,在Hot Chips 2026大会上,OpenAI首次公开自研推理芯片Jalapeño的实测成绩。这颗芯片名字很随意,代号“墨西哥辣椒”,但工程目标很清晰:专为智能体时代的推理负载重新设计硬件。
Jalapeño由OpenAI主导设计、Broadcom代工、台积电N3P工艺制造,从立项到流片只用了约9个月。OpenAI硬件负责人Richard Ho说,测试结果显示“非常显著的性能提升”。具体数字是:在SemiAnalysis维护的InferenceX基准上,用GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1T三款模型测试,Jalapeño每瓦吞吐比英伟达Blackwell系统高出1.5到1.9倍,端到端延迟低1.7到3.6倍。
功耗差距也很明显。Jalapeño只有700W,而Blackwell系统动辄1.2kW以上。这个对比说明OpenAI不是在追求绝对峰值算力,而是在追求推理场景下的能效和延迟稳定性。这正是智能体高频调用、长上下文推理时最需要的特性。
不过也别急着喊“英伟达危险了”。Jalapeño量产要到2027年才会逐步铺开,OpenAI也表示会继续采购英伟达和其他厂商的芯片。短期看,它是OpenAI降低推理成本、保障供应弹性的一步棋;长期看,它代表前沿AI公司开始把竞争从模型层拉到芯片层。
对英伟达来说,真正的信号不是丢了一个客户订单,而是自研芯片开始蚕食推理市场份额。训练和推理本来就像一条河的上游和下游,英伟达现在统治上游,但下游的水量可能正在分流。
A5创业网 版权所有