其他

OpenAI发布自研推理芯片Jalapeño性能数据

OpenAI于8月25日公开首款定制推理芯片Jalapeño的性能参数,直接对标英伟达GB200/GB300。在GPT OSS 120B、DeepSeek R1和Kimi K2.5 1T模型上,Jalapeño每瓦AI工作量比英伟达高1.5至1.9倍,端到端延迟降低1.7至3.6倍,交互式负载性能提升2.1至4.1倍。此举旨在降低推理成本和英伟达依赖,但也面临软件栈与集群互联挑战。

始于 更新至 条相关内容