
8月26日,AI行业迎来重磅消息。OpenAI首款自研推理芯片Jalapeño性能数据出炉,每瓦性能和延迟均优于英伟达GB300,第二代芯片已接近流片阶段;OpenAI完成代号Bel超10T参数预训练,冲击AGI的步伐加速。此外,阿里万相Wan3.0公测支持30秒视频生成、Ox Alpha成OpenRouter史上最大规模发布、GPT-5.6 Sol登陆Microsoft Foundry等也值得关注。本文梳理今日8条最值得关注的AI行业动态。
一、OpenAI首款自研推理芯片Jalapeño性能公布,多项指标跑赢英伟达GB300
8月25日,OpenAI公布了首款自研AI推理芯片Jalapeño(墨西哥辣椒)的首批性能测试结果。这款芯片由OpenAI与博通共同开发,专为大语言模型推理设计。测试数据显示,Jalapeño在多个维度上超越了英伟达GB300。
| 性能指标 | 提升幅度 |
|---|---|
| 每瓦工作量 | 提升1.5-1.9倍 |
| 响应延迟 | 降低1.7-3.6倍 |
| 交互式工作负载性能 | 最高提升4.1倍 |
| 对比基准 | 英伟达GB300(非Vera Rubin系列) |
- 研发合作:OpenAI与博通(Broadcom)共同开发
- 设计亮点:AI产品、模型、芯片和内存从一开始就协同设计
- AI辅助设计:芯片设计过程同样借助了AI辅助
- 二代进展:第二代芯片已接近流片阶段
- 三代启动:第三代芯片研发工作已启动
- 应用价值:更快的ChatGPT响应、更灵敏的Codex会话和智能体
产业意义:OpenAI从”用芯片”走向”造芯片”,标志着AI巨头开始向上游算力层渗透,英伟达的垄断地位面临新的挑战者。
二、OpenAI完成代号Bel超10T参数预训练,冲击通用人工智能
据消息人士爆料,OpenAI近期完成了代号为”Bel”的大型预训练,总参数量超过10T,规模与GPT-4.5相当。Bel被视为此前”Doug”模型的直接继任者,预计将作为Astra和GPT-6(经进一步强化学习后)的基础模型。有观点认为其甚至可能达到AGI阈值。该消息尚未得到OpenAI官方证实。
- 模型代号:Bel
- 参数量级:超过10T(万亿)参数
- 模型定位:Doug的直接继任者
- 下游用途:作为Astra和GPT-6的基础模型(需强化学习进一步优化)
- 规模对比:与GPT-4.5相当
- 消息来源:第三方爆料,未获OpenAI官方确认
三、Ilya新模型即将发布,a16z合伙人称”今年最重要”
a16z合伙人Martin Casado发布预告,称刚刚获得了一个新模型的访问权限,并表示”这将是今年最重要的模型发布,甚至可以去掉之一”。业内普遍猜测这是Ilya Sutskever离开OpenAI后创立的Safe Superintelligence(SSI)公司的首款模型产品。
这将是今年最重要的模型发布,甚至可以去掉之一。
— a16z合伙人 Martin Casado
与此同时,Martin Casado还表示AI初创企业正以极快速度增长,因为AI已让初创企业与微软、Meta等现有巨头站在同一起跑线上。他观察到计算领域正从以工程为主导转向以资本为主导,二十人团队如今即可有效运用十亿美元资金,AI解决了相关问题。
四、阿里万相Wan3.0公测,支持30秒视频生成+文档直接生视频
阿里云万相Wan3.0开启公测,这是通义万相家族第一次把”文档”作为一等输入模态的视频生成模型。单次可生成30秒视频(上一代为15秒),支持文本/图像/音频/视频等多种输入,并首次支持doc/xls/ppt/pdf/md等文档格式直接生成视频。
| 功能 | 详情 |
|---|---|
| 最长视频时长 | 30秒(上一代15秒) |
| 输出帧率 | 30fps |
| 分辨率支持 | 480P / 720P / 1080P |
| 生成方式 | 文生视频、图生视频、参考生视频 |
| 文档支持 | doc/xls/ppt/pdf/md 直接生视频 |
| 智能时长 | 根据提示词自动推荐合适时长 |
| 视频延长 | 支持延展故事走向与剧情发展 |
产品突破:从”生成一个镜头”走向”讲述一段完整的故事”,文档直生视频功能大幅降低企业视频制作门槛。
五、Ox Alpha成OpenRouter史上最大规模模型发布,3天处理11.6万亿tokens
Ox Alpha已成为OpenRouter历史上规模最大的模型发布。发布后前3个完整天内,该模型处理了11.6万亿tokens,是OpenRouter上第二大模型发布量的2.6倍。单日有望处理近6万亿tokens。用户可通过编码代理中的ori工具使用该模型。
| 指标 | 数据 |
|---|---|
| 发布地位 | OpenRouter史上最大规模模型发布 |
| 前3天token量 | 11.6万亿 |
| 对比第二名 | 是第二大模型发布量的2.6倍 |
| 单日峰值 | 近6万亿tokens/天 |
| 使用方式 | 通过ori工具在编码代理中调用 |
六、GPT-5.6 Sol 9月1日登陆Microsoft Foundry,企业级治理能力加持
微软Azure宣布,GPT-5.6 Sol将于9月1日在Microsoft Foundry平台上线。该模型定价为每100万输入token 4美元、每100万输出token 20美元,价格至少持续至2026年11月30日。模型支持高级编码、智能体工作流及100万token上下文窗口,并内置企业级治理能力。
- 上线时间:2026年9月1日
- 部署平台:Microsoft Foundry
- 定价:输入$4/M tokens,输出$20/M tokens
- 价格有效期:至少持续至2026年11月30日
- 核心能力:高级编码、智能体工作流、100万token上下文窗口
- 企业特性:内置企业级治理能力
七、英伟达Hot Chips 2026展示全栈AI平台,主打极致协同设计
在Hot Chips 2026大会上,英伟达提出”极致协同设计”是本届大会的核心主题,旨在加速Agentic工作负载,并称其为”历史上最复杂的工作负载”。英伟达展示了从芯片到网络的全栈AI平台。
- 核心主题:极致协同设计(Extreme Co-Design)
- 目标负载:Agentic工作负载(历史上最复杂的工作负载)
- Vera CPU:专为AI智能体打造的CPU
- Vera Rubin平台:新一代AI计算平台
- Groq 3 LPX:交互式推理加速器,已全面投产
- Spectrum-X Multiplane:AI网络解决方案
- BlueField-4 Scale-In:数据处理单元(DPU)
英伟达认为,这一整套方案构成完整的AI堆栈平台,以应对Agentic时代对算力和网络架构的挑战。就在同一天,OpenAI发布了自研Jalapeño芯片的性能数据,两大玩家在AI算力赛道的竞争愈发激烈。
八、两AI研究员拒Bezos项目领导职位,另创公司发布物理世界建模系统
两位AI研究员曾婉拒Jeff Bezos支持的Project Prometheus提供的领导职位,转而离职创立新公司Accelerated Understanding,并发布了一款用于物理世界建模的AI系统。该公司由加州理工学院教授Anima Anandkumar参与创立。目前,关于该系统的技术细节、具体功能及公司的其他信息尚未披露。
- 新公司名称:Accelerated Understanding
- 核心产品:物理世界建模AI系统
- 创始人背景:婉拒贝索斯Project Prometheus领导职位
- 核心成员:加州理工学院教授Anima Anandkumar参与创立
- 行业趋势:物理AI成为新的创业热点方向
写在最后:今日AI行业动态的核心关键词是”自主”与”突破”。OpenAI自研芯片Jalapeño的性能公布,标志着AI巨头开始打破对第三方算力的依赖,走向芯片-模型-应用全栈自主可控;Bel超10T参数预训练的消息,则预示着前沿模型规模仍在快速攀升。而阿里Wan3.0的文档直生视频、Ox Alpha的爆发式增长,则从应用层面展示了AI技术的商业化落地正在加速。算力、模型、应用三层同步突破,AI行业正进入一个更加激烈也更加精彩的新阶段。
延伸阅读
- 2026年8月25日AI行业资讯速览 — 了解昨日AI行业动态,保持信息连续性
- 2026年8月24日AI行业资讯速览 — 回顾本周AI行业热点事件
- Seedance 2.5深度测评:配合火山剧创,AI短剧工业化走到了哪一步 — 了解AI视频生成领域的最新进展
- GPT-5.6深度测评:三档模型体系重塑AI生产力 — 深入了解OpenAI最新模型的技术细节
