OpenAI 自研推理芯片 Jalapeño

直接说重点:OpenAI 自己造芯片了。

不是传言,不是包个英伟达的皮,是 OpenAI 亲手设计的第一块推理芯片,代号 Jalapeño,磨了整整 16 个月。

先看硬实力。

这块芯片首发用上 HBM4 内存,带宽拉到 15.4TB/s,功耗只有 700W。什么概念?跟英伟达的 H100 比,算力高出 72%,功耗还更低。

OpenAI 拿自家模型实测:GPT、DeepSeek-R1、Kimi 都能跑,每瓦吞吐是商用 GPU 服务器的 3.2 倍。翻译成人话——一样的电费,活干得更多;每百万 token 的成本,据说能降六成。

英伟达最怕的事情,这不就来了吗。

过去几年,AI 圈有句大实话:不管谁做模型,最后都得找英伟达买卡。GPU 一卡难求,定价权全攥在别人手里。模型厂商看着风光,其实是在给英伟达打工。

OpenAI 显然不想一直打工。

造芯片这事,它两年前就动了心思,今年 4 月公开认领,现在第一块就成了。从”软件公司”变成”软硬通吃”,这步棋下得很大。

有个细节值得咂摸:这块芯片先死磕的是推理,不是训练。为什么?因为推理才是大模型真正赚钱的环节——用户每问一次,就是一次推理,就是一分真金白银。把这块成本打下来,利润率才能翻着倍往上走。

这背后是一盘更大的棋。

以前 AI 竞争比的是参数,谁家大谁说话。现在换了赛道,比的是芯片怎么设计、电费怎么省、系统怎么协同。芯片江湖,正在从英伟达一家独大,走向英伟达、博通系、AMD 三方角力。OpenAI 这一刀,捅在了最痛的地方。

当然,新芯片刚出,良率稳不稳、供货跟不跟得上、价格到底香不香,都得等量产来验证。Jalapeño 能不能真的撼动英伟达,时间会给答案。

但有一件事已经板上钉钉:AI 的账,算得越来越细了。谁把成本控住,谁就握住了下一个时代的钥匙。