OpenAI 称其 Jalapeno 芯片性能超越英伟达 GB300
(源初/文)在三款测试模型中,Jalapeno 在峰值吞吐量下每瓦特产生的 AI 工作量是竞争系统的1.5 至 1.9 倍,同时延迟降低了1.7 至 3.6 倍。
针对 Agent(智能体)等高互动性工作负载,其优势进一步扩大到2.1 至 4.1 倍的性能提升。在测试的最大模型 Kimi K2.5 上,Jalapeno 展现出比对比硬件高出约1.5 倍的能效比(每瓦性能),以及3.4 倍的低延迟。
OpenAI 表示,为了保持对比的一致性,他们使用各芯片公布的额定功耗对结果进行了标准化处理。Jalapeno 的标称功耗为 700 瓦,不过公司透露,在实际测试中,测得的功耗一直保持在 550 瓦或以下。
该芯片的设计旨在专门优化语言模型推理的两个不同阶段:计算密集的 Prefill(预填阶段)和更依赖内存带宽的 Decode(解码阶段)。
OpenAI 指出,Jalapeno 将模型状态和缓存数据保留在单个连接系统本地,从而减少了以往数据在不同芯片间传输时常出现的通信延迟。
AI 本身也在该芯片的研制中发挥了作用。OpenAI 解释称,其旗下模型协助设计了 Jalapeno,将从概念提出到 Tapeout(流片)的开发周期缩短至 9 个月。
工程师们还利用公司的 Codex 工具,在 2 个月内让另外三款开源模型实现了强劲的性能表现。其中,由 AI 生成的部分模型组件代码,运行速度比人类工程师编写的版本快了高达1.8 倍。
OpenAI 计划在今年年底前开始在其自家基础设施中部署 Jalapeno,并将其定位为多代产品路线图中的首款芯片;其后续迭代产品已在开发中。公司同时补充道,除使用自研芯片外,还将继续购买来自 Nvidia(英伟达)及其他供应商的芯片,以满足日益增长的计算需求。
值得注意的是,Jalapeno 未与 Nvidia 最新推出的 Vera Rubin 芯片进行对比测试(后者近期才开始出货),且该芯片完全专为推理而设计,并非针对 Nvidia 仍占据主导地位的模型训练工作负载。
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
6G新变革:当网络变“聪明”,普通消费者如何受益?
无论是4G、5G,还是6G,对于普通消费者而言,可能无法分辨其中的区别,也不关心连接方案通过什么样的底层技术方案,只有更好的体验才能产生明显的升级感知。与此同时,消费者的连接需求,又..[详细]
探访算电协同内蒙古实践:一条完整绿算产业链是如何炼成的
“十四五”期间,内蒙古建设了大量先进的数据中心,既是全国八大算力枢纽节点之一,也是国家算力枢纽中明确以绿色算力为核心标签的节点,在算力与电力协同领域取得了丰富的成果。“十五五”..[详细]
三大运营商2026半年报:传统连接业务承压,算力、AI强势突围
近期,中国移动、中国电信、中国联通先后发布了2026年半年度财报。从公开数据及业绩交流会披露信息来看,受增值税税目政策调整、国内通信市场进入存量阶段、新旧动能转换多重因素共同影响,..[详细]
2026世界机器人大会观察:机器人从“炫技”切换到“打工”模式
2026世界机器人大会在北京落下帷幕。本届大会以“人机共生 产需共融”为主题,集中展示全球机器人与人工智能领域的技术创新与应用落地成果。[详细]
携手产业、软硬协同:鸿蒙生态(长沙)创新中心打出组合拳
近年来,万物互联的智能世界正在加速成为现实,作为智能世界基础支撑的操作系统也在加速拥抱AI、融入各行各业的每一个应用场景。在此过程中,鸿蒙生态迎来了难得的发展机遇,技术升级日新月..[详细]
我国eSIM手机产业在终端适配、运营商服务等方面取得阶段性进展
2025 年 10 月 14 日,工业和信息化部正式批复中国电信、中国移动、中国联通三大基础电信运营商开展eSIM手机运营服务商用试验。同日,三家运营商同步宣布在全国31 个省、自治区、直辖市上线 ..[详细]













