美国时间8月25日,人工智能研究实验室OpenAI宣布了其首款定制推理芯片Jalapeño的性能数据。这款芯片在能效和响应速度方面展现出显著优势,与英伟达的旗舰AI服务器GB200和GB300相比,Jalapeño在单位功耗下能处理更多的AI工作负载,并且响应速度更快。
OpenAI表示,Jalapeño芯片通过单一架构实现了更高的吞吐量和更低的延迟。在GPTOSS120B、DeepSeekR1和KimiK2.51T这三种大型模型上,Jalapeño在峰值吞吐量下每瓦可完成的AI工作量比英伟达高出1.5至1.9倍,端到端延迟则降低了1.7至3.6倍。对于需要高度交互性的工作负载,Jalapeño的性能提升了2.1至4.1倍,这表明其在处理大规模AI任务时具有更高的效率和更快的处理速度。
来源:一电快讯
返回第一电动网首页 >
以上内容由AI创作,如有问题请联系admin#d1ev.com(#替换成@)沟通,AI创作内容并不代表第一电动网(www.d1ev.com)立场。
文中图片源自互联网或AI创作,如有侵权请联系邮件删除。