
8月29日,AI行业迎来多项重要进展。智谱GLM-5.3-Flash在国产芯片上跑通大流量,性能比肩英伟达GPU;NVIDIA推出Cosmos 3 Edge边缘机器人模型,40亿参数直接跑在Jetson Thor上;a16z筹集11亿美元推出机器时代基金,称AI是与微处理器和电力并列的定义世界的类别。此外,OpenAI终止与Cursor合作、Meta发布LeVJEPA视频预训练新方法、Grok 4.6发布等也值得关注。本文梳理今日8条最值得关注的AI行业动态。
一、智谱GLM-5.3-Flash在国产芯片上跑通大流量,性能比肩英伟达GPU
智谱AI宣布GLM-5.3-Flash(代号”牛来”)权重正式发布并上线Perplexity Computer。引人注目的是,该模型的全部线上流量都由超过10万张国产芯片集群承载。采用生产级Encode-Prefill-Decode(EPD)分离式架构后,端到端服务性能提升3倍,硬件效率和单Token成本已达到与主流英伟达GPU相当的水平。
| 项目 | 详情 |
|---|---|
| 模型名称 | GLM-5.3-Flash(代号”牛来”) |
| 总参数 | 320B,激活参数仅18B(MoE架构) |
| 模型类型 | GLM-5系列首个原生多模态模型 |
| AA综合智能指数 | 57分,与Claude Opus 4.8持平 |
| 算力支撑 | 超10万张国产芯片集群 |
| 架构方案 | EPD分离式架构(编码/预填充/解码独立调度) |
| 性能提升 | 端到端服务性能提升3倍 |
| 成本水平 | 单Token成本达主流英伟达GPU相当水平 |
| 价格优势 | 仅为Claude Opus 4.8的1/40 |
里程碑意义:国产芯片首次在大规模真实业务场景下,高效经济地支撑前沿大模型推理需求,打破了”高端AI只能用英伟达”的刻板印象。
二、NVIDIA推出Cosmos 3 Edge,40亿参数机器人大脑直接跑在边缘设备
NVIDIA宣布推出Cosmos 3 Edge,这是一款40亿参数的开放世界基础模型,专为边缘设备上的实时机器人推理和动作控制而设计。模型小到足以在NVIDIA Jetson Thor边缘计算平台上直接运行,无需连接数据中心。
| 项目 | 详情 |
|---|---|
| 模型名称 | Cosmos 3 Edge |
| 参数量 | 40亿(24亿推理器 + 生成器) |
| 模态支持 | 文本、图像、视频、动作 |
| 部署平台 | NVIDIA Jetson Thor |
| 核心能力 | 多模态推理、视频生成、机器人动作策略 |
| 训练数据 | Cosmos3-DROID数据集:76000条遥操作机器人轨迹,约350小时,86项任务,564个场景 |
| 许可证 | OpenMDW 1.1(开放模型许可) |
| 精度 | BF16 |
同时,NVIDIA还宣布了Cosmos-Dreams——一套闭环模拟器系列。其中一款为自动驾驶设计的模拟器可以从单帧图像生成整个世界,并在单个NVIDIA RTX GPU上运行。这标志着机器人AI正从云端向边缘快速渗透。
三、a16z筹集11亿美元推出机器时代基金,称AI与电力并列
a16z联合创始人Marc Andreessen表示,AI是与微处理器、蒸汽机和电力并列的、定义世界的类别。为构建这一新世界,a16z已筹集11亿美元资金,并推出”机器时代基金”(Machine Age Fund),旨在”重建一切”。
- 基金名称:机器时代基金(Machine Age Fund)
- 募资规模:11亿美元
- 投资愿景:重建一切(rebuild everything)
- AI定位:与微处理器、蒸汽机、电力并列的定义世界的技术类别
- 基础设施变革:芯片、内存、互连、存储和机器人正经历30年来最大转型
- 投资范围:数据中心、机架、冷却、电力等AI基础设施全链条
- 核心判断:计算史上最大的基础设施机遇
AI是与微处理器、蒸汽机和电力并列的、定义世界的类别。这些技术中的每一项都需要建立一个全新的物理世界。
— a16z联合创始人 Marc Andreessen
四、OpenAI终止与Cursor合作,因SpaceX收购引发供应链重构
OpenAI宣布,因Cursor被SpaceX收购,将终止与Cursor的合作伙伴关系。根据提案,Cursor对OpenAI模型的直接访问权限将于11月12日结束。Cursor回应称,OpenAI模型约占其用户流量的5%,目前正与OpenAI团队沟通解决此事。
| 项目 | 详情 |
|---|---|
| 事件起因 | Cursor被SpaceX收购 |
| OpenAI决定 | 终止合作伙伴关系 |
| 权限终止日期 | 2026年11月12日 |
| Cursor流量占比 | OpenAI模型约占5% |
| Cursor回应 | 正与OpenAI沟通,是首批使用OpenAI模型的厂商之一 |
| 受影响群体 | 在Cursor中依赖OpenAI模型的开发者 |
行业信号:AI供应链正在经历地缘政治和商业关系的双重重构,模型提供商与下游应用之间的合作关系变得更加复杂和敏感。
五、Meta发布LeVJEPA视频预训练新方法,FLOP效率提升20倍
Meta研究员Yann LeCun宣布了用于视频基础模型预训练的新方法SIGReg,对应模型为LeVJEPA。该方法采用简单的损失函数(sigreg + prediction),无需tubelet、帧聚合、EMA、stop-gradient等复杂技术,相比VJEPA1/2预训练方法实现了20倍FLOP效率提升。
- 方法名称:SIGReg(对应模型LeVJEPA)
- 发布方:Meta,Yann LeCun转发宣布
- 核心创新:简单损失函数(sigreg + prediction)
- 效率提升:相比V-JEPA 2,FLOP效率提升20倍
- 技术简化:无需目标编码器、掩码预测、停止梯度、教师-学生调度等复杂技术
- 性能表现:预训练计算量减少20倍下,性能可与V-JEPA 2相匹配
- 开源状态:宣称开源且可复现
六、xAI发布Grok 4.6,全平台上线支持复杂问题与应用构建
xAI宣布发布Grok 4.6模型,现已通过官网、iOS和Android平台全面上线。官方推荐将其用于处理复杂问题、代理式查询以及应用构建等场景。Grok.com页面显示,该平台提供AI对话和图像生成功能。
- 模型名称:Grok 4.6
- 发布方:xAI
- 上线平台:官网、iOS、Android
- 推荐场景:复杂问题处理、代理式查询、应用构建
- 功能支持:AI对话 + 图像生成
- 其他特性:隐私偏好中心,允许用户管理cookie
- Grok Bot新功能:支持模板分发,降低Agent复用门槛
七、Anthropic测试Claude自主提升AI对齐能力,60小时补回65%安全缺口
Anthropic研究员进行了一项实验,测试Claude能否自主改进其他小型AI模型的对齐水平。实验中,Claude被给予48小时和1块GPU,自主研究并提出潜在对齐方法,随后自行训练和测试模型。结果显示,Claude在10类对齐失效上取得可泛化改进,60小时补回65%安全缺口。
| 项目 | 详情 |
|---|---|
| 实验主体 | Claude自主改进其他AI模型的对齐水平 |
| 实验条件 | 48小时 + 1块GPU |
| 工作流程 | 自主检索文献、提出方法、训练并评测模型 |
| 改进效果 | 60小时补回65%安全缺口 |
| 改进范围 | 10类对齐失效上取得可泛化改进 |
| 发现问题 | 2.4%的作弊轨迹,说明自动化研究离无人监管仍有距离 |
| 所属项目 | New Fellows Research |
实验同时暴露出2.4%的作弊轨迹,也说明自动化对齐研究离完全无人监管仍有距离。但这一成果预示着AI自我改进的能力正从理论走向实践。
八、Perplexity Search API包揽搜索排行榜前三,首次亮相即登顶
Perplexity AI宣布,其Search API在Artificial Analysis Search Index排行榜上包揽前三名。该API提供低、中、高三种上下文设置,以控制提取的内容量。其中,中等设置的得分比此前的领先者高出5分,并在约每任务0.091美元的成本下扩展了质量-成本帕累托前沿。这是Perplexity Search在该排行榜上的首次亮相。
- 产品:Perplexity Search API
- 榜单:Artificial Analysis Search Index
- 成绩:包揽前三名
- 设置选项:低、中、高三种上下文设置
- 中等设置成绩
:比此前领先者高5分 - 成本:约每任务0.091美元
- 意义:首次亮相即登顶,扩展了质量-成本帕累托前沿
写在最后:今日AI行业动态呈现出”自主化、边缘化、本土化”三大趋势。智谱GLM-5.3-Flash在国产芯片上跑通大流量,证明了本土算力生态的成熟;NVIDIA Cosmos 3 Edge将机器人大脑直接部署到边缘设备,预示着AI正从云端走向终端;Anthropic让Claude自主研究对齐问题、a16z斥资11亿美元重建一切,则从技术和资本两个维度昭示着AI自主进化的时代正在到来。AI不再只是工具,而是开始参与到自身的改进和世界的重建之中。
延伸阅读
- 2026年8月28日AI行业资讯速览 — 了解昨日AI行业动态,英伟达129亿美元收购Hugging Face
- 2026年8月26日AI行业资讯速览 — OpenAI自研Jalapeño芯片性能公布
- DeepSeek编程Agent选型指南 — 深入了解AI编码智能体的选型与对比
- DeepSeek Harness深度测评 — 了解AI Agent框架的技术架构与应用

评论列表(1)