智快网
快讯 行业 产业 汽车 科技 AI+ 热点

OpenAI自研芯片Jalapeño:AI设计新速度,挑战英伟达市场地位

2026-08-28来源:快讯编辑:瑞雪

OpenAI近日宣布推出首款自研AI芯片Jalapeño,这款专为推理任务设计的芯片在多项性能指标上超越了英伟达当前最先进的GB300,引发行业震动。据半导体研究机构SemiAnalysis披露,Jalapeño在单位功耗处理能力与响应速度两大核心指标上均领先于英伟达同类产品,标志着AI公司开始深度介入芯片设计领域。

测试数据显示,在运行GPT-OSS 120B模型时,Jalapeño每秒可生成1459个Token,而GB200仅为535个;端到端延迟方面,Jalapeño完成单个任务仅需1.65秒,较GB300的6秒缩短72%。更引人注目的是,当GB300达到最大解码速度时,Jalapeño的吞吐量仍能达到其104.3倍。在能效比这一关键指标上,Jalapeño在GPT-OSS模型上达到每兆瓦每秒5300万个Token,远超GB200 NVL72的1000万水平。

这款芯片采用700瓦低功耗设计,通过将计算核心与HBM4内存直接绑定,实现了15.4TB/s的单封装内存带宽。SemiAnalysis指出,Jalapeño的每瓦HBM带宽达到22,显著优于英伟达Rubin的11.1和GB300的5.71。芯片负责人Richard Ho表示,这种设计有助于数据中心将电力成本降低40%以上,系统级每小时总拥有成本控制在1.56美元,与英伟达H100持平。

开发过程中,OpenAI大量运用AI工具加速设计进程。内部模型GPT-Astra与扩展版Codex深度参与研发,在两个月内将三个开源模型优化至高性能状态。AI辅助设计使SIMD单元面积缩减8%,矩阵引擎面积缩减10%,部分内核代码生成速度比人类工程师快1.8倍。这种"用AI设计AI芯片"的模式,使得Jalapeño从启动设计到完成流片仅用16个月,远低于行业平均18-36个月的周期。

尽管性能出众,SemiAnalysis提醒需关注若干限制因素。当前测试基于8k1k工作负载,尚未完成多轮长上下文场景的AgentX套件测试。与采用HBM4的英伟达Vera Rubin相比,Jalapeño在总拥有成本上优势并不明显。更关键的是,该芯片仍处于工程样片阶段,量产计划要等到2027年才会逐步实施。

在软件生态方面,OpenAI采用自研内核语言Gluon和推理引擎"Teacup",摆脱了对CUDA架构的依赖。这种策略使团队在8天内将张量并行规模从TP8扩展至TP32,实现了跨机架部署。SemiAnalysis分析认为,英伟达Rubin虽提前一个月完成流片,但软件成熟度明显滞后,反映出传统厂商在架构创新上的包袱。

规模化部署方案显示,每个机柜将集成128颗Jalapeño芯片,双机柜系统功耗160kW,与英伟达GB300双宽机柜相当。OpenAI已与Celestica合作开发扩展网络,单个域最多可连接2048颗芯片。更值得关注的是,公司与Broadcom签署的10GW定制加速器协议,规模相当于十座核电机组的发电能力,预示着AI芯片竞赛将进入新的量级。

苹果发布会Logo藏玄机:iPhone 18 Pro或迎新配色与相机系统升级
此前,外界已经多次传出苹果计划为iPhone引入可变光圈摄像头,而如果这一功能最终落地,将成为苹果手机影像系统的一项重要变化。如果苹果iPhone 18 Pro Max采用机械可变光圈方案,用户未来可能能够…

2026-08-28

机器人走出赛场遇挑战,自变量WALL-SS搭建虚拟场助力真实应用
研究团队还把多套机器人策略分别放进 WALL-SS 和真实世界测试,在虚拟世界里执行效果很好的动作策略,搬到物理世界往往也有好的结果。 当然WALL-SS 还没有把机器人直接带到这个阶段,这篇论文的真机实…

2026-08-28

英特尔14A制程缺陷密度曲线达22nm后最佳,2027年试产2028年将量产
将 14A 与 22nm 对比,一定程度上也反映出英特尔近年来在先进制程推进上的坎坷:14nm 首发时表现不佳,10nm 则遭遇严重挫折。英特尔预计,14A 和 EMIB-T 等先进技术将从 2027 年底…

2026-08-28

2026折叠屏手机选购指南:女性用户如何挑选兼具颜值与实力的掌心好物
很多用户初上手荣耀 Magic V5 时,会被它 8.8mm 的极致纤薄所惊艳,而这份轻薄的底气,恰恰来自京东方为其深度定制的全新轻薄柔性OLED折叠屏解决方案。本次推荐的机型中,以京东方技术体系驱动的荣耀…

2026-08-28

面壁智能四周年:端侧智能成主战场,未来三场硬仗锚定通用智能新高度
瑞财经吴文婷8月26日,据媒体报道,面壁智能成立四周年之际,CEO李大海、首席科学家刘知远及联创团队发布内部信,复盘发展历程并公布下一阶段战略方向。 全员信最后强调,面壁智能要成为的,不是一个只会做模型的团…

2026-08-27

英伟达黄仁勋回应“循环融资”质疑:AI初创发展需海量资本支撑
在接受 CNBC 主持人吉姆 · 克莱默(Jim Cramer)采访时,黄仁勋表示,这些融资安排反映的是打造前沿 AI公司所需要的前所未有的巨额资本。黄仁勋表示,英伟达希望成为这些顶尖 AI 公司的股权投…

2026-08-27

智谱开源GLM-5.3-Flash多模态模型:性能超越前代,国产芯片高效支撑
GLM-5.3-Flash同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Con…

2026-08-27

英伟达前AI总监携新架构挑战Transformer,5万亿上下文物理AI开启宇宙模拟新纪元
当我们在为大语言模型能写出一首好诗、能帮我们润色工作邮件而欢呼时,Accelerated Understanding像一个从未来穿越回来的破壁人,冷酷地告诉我们:语言和图像只是人类理解世界的表象,物理法则,…

2026-08-27