主 题:核弹来袭!OpenAI的自研推理芯片Jalapeño实现对GB300的全方面超越
发 布 者:fotxitek
标签分类: 日常
时 间:2026-08-26 00:57:19
内容预览:核弹级消息!OpenAI首款自研推理芯片Jalapeño直接吊打Nvidia GB200/GB300!DeepSeek、Kimi性能大幅提升!OpenAI刚刚公布自研芯片首批InferenceX基准实测结果:🔸效率碾压:在GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 三个1T级开源模型上,峰值吞吐量每瓦特工作量提升1.5–1.9倍🔸延迟暴降:端到端延迟降低1.7–3.6倍,高交互工作负载性能更高达2.1–4.1倍🔸功耗惊喜:额定700W,实测工作负载稳定≤550W,远比Nvidia算力卡更省电🔸部署时间表:2026年底开始小规模部署,Gen2已深度开发,Gen3正在成形🔸战略意义:专注推理(非训练),减少对Nvidia依赖,全栈优势让未来模型更快更便宜更可扩展总结Jalapeño 对 GB200:峰值 AI 推理吞吐/功耗大约提升 90%;极低延迟场景下单用户生成速度提升 173%。Jalapeño对比GB300在高并发峰值吞吐/瓦方面优势提升约 50%~90%,在Agent、Coding Agent 这种追求低 TBT、连续生成的场景,提升约 2.7~4.1 倍的单用户推理速度,Jalapeño 对 GB300:峰值推理能效约提升 50%-70%,极低延迟单用户生成速度提升约280%~315%。推理成本要崩了,750 token/s可能很快成标配。https://openai.com/index/jalapeno-first-results/
直达链接: https://www.nodeseek.com/post-894223-1
发 布 者:fotxitek
标签分类: 日常
时 间:2026-08-26 00:57:19
内容预览:核弹级消息!OpenAI首款自研推理芯片Jalapeño直接吊打Nvidia GB200/GB300!DeepSeek、Kimi性能大幅提升!OpenAI刚刚公布自研芯片首批InferenceX基准实测结果:🔸效率碾压:在GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 三个1T级开源模型上,峰值吞吐量每瓦特工作量提升1.5–1.9倍🔸延迟暴降:端到端延迟降低1.7–3.6倍,高交互工作负载性能更高达2.1–4.1倍🔸功耗惊喜:额定700W,实测工作负载稳定≤550W,远比Nvidia算力卡更省电🔸部署时间表:2026年底开始小规模部署,Gen2已深度开发,Gen3正在成形🔸战略意义:专注推理(非训练),减少对Nvidia依赖,全栈优势让未来模型更快更便宜更可扩展总结Jalapeño 对 GB200:峰值 AI 推理吞吐/功耗大约提升 90%;极低延迟场景下单用户生成速度提升 173%。Jalapeño对比GB300在高并发峰值吞吐/瓦方面优势提升约 50%~90%,在Agent、Coding Agent 这种追求低 TBT、连续生成的场景,提升约 2.7~4.1 倍的单用户推理速度,Jalapeño 对 GB300:峰值推理能效约提升 50%-70%,极低延迟单用户生成速度提升约280%~315%。推理成本要崩了,750 token/s可能很快成标配。https://openai.com/index/jalapeno-first-results/
直达链接: https://www.nodeseek.com/post-894223-1