【财新网】宣布推出自研芯片后,OpenAI进一步展示研发成果。美国时间8月25日,OpenAI公布旗下首款定制推理芯片Jalapeño的性能,并称:相比英伟达的旗舰AI服务器GB200和GB300等,Jalapeño能够以更低的单位功耗处理更多AI工作负载,同时更快响应。
OpenAI称,Jalapeño通过单一架构同时实现了更高吞吐量和更低延迟,在GPT OSS 120B、DeepSeek R1和Kimi K2.5 1T这三种大模型上,Jalapeño在峰值吞吐量下每瓦可完成的AI工作量,比英伟达高出1.5至1.9倍,端到端延迟则降低1.7至3.6倍;对于高度交互式工作负载,其性能提高了2.1至4.1倍。



















京公网安备 11010502034662号 