|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
卡城新闻 加国新闻 即时新闻 娱乐八卦
最新科技 读者文摘 养生保健 美食饮品
居家生活 移民茶馆 艺术中心 风筝专辑 房屋租赁 求职招聘 便民广告 定居指南 城市介绍 房产动态 留学移民 华人故事 教育话题 财经信息 精华旅游 难得一笑 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
卡城新闻 加国新闻 即时新闻 娱乐八卦 最新科技 读者文摘 养生保健 美食饮品 居家生活 移民茶馆 艺术中心 风筝专辑 房屋租赁 求职招聘 便民广告 定居指南 城市介绍 房产动态 留学移民 华人故事 教育话题 财经信息 精华旅游 难得一笑 |
| 最新科技 |
 卡城华人网信息中心![]()  最新科技
     ![]()  OpenAI自研芯片首测:推理性能碾压GB200/GB300
|
|
【卡城华人网 www.calgarychina.ca】  2026-08-26 10:38   免责声明: 本消息未经核实,不代表网站的立场、观点,如有侵权,请联系删除。 |
|
在史丹佛大学举办的Hot Chips 大会上,OpenAI 公开首款客制化AI 晶片「Jalapeño」更多细节。这款晶片在6 月首次对外亮相,是OpenAI 与博通(Broadcom)共同设计,以推动OpenAI 在AI 基础设施的发展。 OpenAI 以每个机柜搭载128 颗晶片的阵容来部署Jalapeño,「一个完整的Pod 就有2,048 颗晶片」,OpenAI 硬体产品负责人Richard Ho 表示。这128 颗晶片的配置,具备1.7 exaFLOPS 的4 位元运算能力,以及27.5TB 的HBM4,每颗封装具有15.4TBps 的记忆体频宽。 Richard Ho 指出,OpenAI 以三款模型对Jalapeño 进行测试,包括自家gpt-oss-120b,以及DeepSeek-R1、Kimi K2.5。 「在我们尝试的这三款模型,证明了这套架构不仅适用于内部模型,同样也适用于其他模型。」他说,「这是一款通用型、极具弹性的AI 加速器。」 在半导体研究机构SemiAnalysis 的InferenceX 基准测试,OpenAI 声称,以Jalapeño 为基础的系统在这三款模型上,峰值吞吐量多出1.5 倍至1.9 倍的AI 工作量,并具备相较竞争对手平台低1.7 倍至3.6 倍的端到端延迟。而在超低延迟情境,测试表现快上2.1 倍至4.1 倍。 OpenAI 使用各种晶片公布的晶片额定功耗对结果进行标准化,Jalapeño 的额定功耗为700W,但在测试工作负载中测得的持续攻好,这款晶片保持在550W 或更低。
▲ 每千瓦可完成的AI 工作量提高1.5~1.9 倍。 虽然OpenAI 声称推理效能胜过NVIDIA 的GB200 NVL72 和GB300 NVL72 机柜系统,但OpenAI 并不打算放慢部署NVIDIA 产品的脚步。 「这是我们整体运算资源策略的一部分,策略上涵盖NVIDIA、Cerebras 等非常非常出色的合作伙伴。」Richard Ho 表示,「我们有着相当庞大的运算需求,而我们不可能一次就全部满足。」 当被问及OpenAI 是否会将自研晶片对外销售给其他公司时,Richard Ho 表示「OpenAI 内部有着相当庞大的运算需求,要满足这些需求需要大量的运算资源,我们光是要有足够的量都相当吃力。」 OpenAI 声称,Jalapeño 有一部分是在AI 的协助下开发而成,这也让整个开发流程比以往更加迅速。 「我们运用AI,得以在晶片塞入更多的运算能力。」Richard Ho 补充说,Jalapeño 第二代已进入深度开发阶段,甚至第三代已在进行中。 Jalapeño 预计今年稍晚以有限数量部署在OpenAI 资料中心,并在明年进一步广泛部署。 来源:科技新报 编辑(Edit)     删除(Delete) |
|
|
|
| 版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca |
| 版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca |