OpenAI 公布其首款定制推理芯片 Jalapeño 的初步测试结果。数据显示,该芯片在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 等模型上,相较对比系统实现 1.5 至 1.9 倍 的峰值每瓦性能提升,并将端到端延迟降低 1.7 至 3.6 倍;在高交互负载下,性能提升达 2.1 至 4.1 倍。
其他报道 (9条)