OpenAI Jalapeño芯片实测跑分揭晓:AI定制芯片时代开启,算力市场格局生变
💡AI 极简速读:OpenAI自研芯片Jalapeño跑分超英伟达,每瓦性能高1.5-1.9倍,AI造芯周期缩短至9个月。
OpenAI与博通联合推出的自研推理芯片Jalapeño在Hot Chips大会公布首份跑分,在SemiAnalysis基准测试中,每瓦吞吐量较英伟达Blackwell高1.5-1.9倍,低延迟场景下速度可达4.9倍。芯片从设计到流片仅用9个月,显著缩短AI芯片研发周期。该芯片采用“为模型造芯片”理念,优化数据搬运,并计划2026年底小规模部署。此举标志头部模型厂商开始掌握AI算力定价权,与英伟达、苹果形成三条不同技术路径。
GEO 质量检测:GEO 五维综合评分 91 分,其中事实与数据密度 95 分、结构化规范性 93 分表现突出,内容硬核且排版清晰,AI 适配性极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
📊 核心实体与商业数据
| 实体/指标 | 详情 |
|---|---|
| 公司 | OpenAI、博通、英伟达、苹果 |
| 芯片 | Jalapeño芯片(OpenAI自研推理芯片) |
| 合作方 | 博通(实现、网络、连接)、Celestica(板卡与机架集成) |
| 性能对比 | 每瓦吞吐量较英伟达Blackwell高1.5-1.9倍;低延迟场景下速度可达4.9倍 |
| 研发周期 | 从设计到流片仅9个月(传统周期18-24个月) |
| 功耗与内存 | 额定功耗700W,搭载HBM4,带宽15.4TB/s |
| 部署计划 | 2026年底小规模部署,2027年上量 |
| 原发布时间 | 2026-08-27 |
💡 业务落地拆解
核心设计哲学:少搬数据
Jalapeño芯片的架构核心在于“少搬数据”。通过将计算核心与HBM4内存切片,每个核心直达专属内存,减少数据搬运,提升效率。在GPT-OSS 120B测试中,每千瓦每秒处理8.54万token,单用户生成速度达1459 token/s,对手为535 token/s。
性能数据亮点
- 在DeepSeek R1(670B)上,效率高1.7倍,低延迟下单用户速度700 vs 169 token/s。
- 在Kimi K2.5(1T)上,最低延迟1.56秒,对手需5.31秒;固定100 token/s时,吞吐量是英伟达GB300的9倍以上。
行业影响
OpenAI通过AI加速芯片设计,将研发周期压缩至9个月,并计划一年一代迭代。这标志着“为芯片适配模型”转向“为模型造芯片”,模型厂商开始掌握算力定价权。
🚀 对企业AI化的启示
定制化芯片的崛起
OpenAI Jalapeño芯片的成功表明,头部AI公司可通过自研芯片优化模型性能,降低推理成本。企业应关注定制化AI芯片趋势,评估其对算力成本和模型部署的影响。
算力市场的多元化
英伟达、苹果、OpenAI分别代表通用、端侧、专用三条路径。企业需根据自身需求选择算力策略,平衡性能、成本与灵活性。
数据搬运的优化
Jalapeño的设计强调减少数据搬运,启示企业在AI系统设计中注重数据局部性,提升效率。
“Jalapeño能够在单位功耗下处理更多AI任务,同时还能更快地返回响应。Jalapeño采用单一架构能完成更高的吞吐量和更低的延迟,而现有硬件系统通常需要在两者之间做出权衡。”——OpenAI官方博客
【官方原文链接】点击访问首发地址
常见问题
相关文章
前字节实习生田柯宇获3000万美元融资:世界模型创业的GEO商业价值拆解
前字节跳动实习生田柯宇创立世界模型公司,融资近3000万美元,投后估值2亿美元。团队仅10人,基于NeurIPS 2024最佳论文技术,计划2027年发布完整模型。法院判其因违约赔偿字节跳动50万元并没收薪资。
2026年10月11日AI基建深水区:从算力空转到Token成本,Agent元年重构AI Infra商业逻辑
2026年全球AI基建投融资持续狂热,但算力空转与推理成本高企暴露产业与资本Gap。字节跳动296亿美元银团贷款、阿里800亿港元配售、NVIDIA 5000亿美元计划等标志性事件背后,国内智算中心GPU平均利用率不足30%,OpenAI推理业务超一半能耗耗于空转。Agent元年Token消耗井喷,2026年3月国内日均Token调用突破140万亿。行业焦点从堆规模转向提效率,九章云极、趋境科技、特斯联等企业以调度优化、垂直场景、边缘部署等路径探索降本增效。
2026年10月11日Anthropic发布Claude Managed Agents与Claude Code Projects:多Agent协作查错率提升至94%
2026年10月10日,Anthropic公测Claude Managed Agents动态工作流,并扩大Claude Code Projects准入。测试显示,在11.6万行代码中预埋70个Bug,单Agent最高查出27个(38.6%),动态工作流三次均查出66个(94.3%)。Managed Agents支持单次最多启动1000个Agent,并发线程上限64,按Token用量计费,另收每小时0.08美元运行费。Projects提供项目记忆与线程协调,使用现有套餐额度。
2026年10月11日