
9月3日,AI行业迎来模型发布”对决日”。Google发布Gemini 3.8 Flash与Flash Cyber两个新模型,距3.7 Flash发布仅三周;Meta数小时后迅速推出Muse Spark 1.3回应,Artificial Analysis评测得分62分超越Gemini 3.8 Flash的59分,与Claude Fable 5持平,但成本低8-12倍。此外,美国政府首次表态支持OpenAI训练LLM属合理使用、OpenAI与Anthropic在curl代码库报告零安全问题后AISLE发现6个零日漏洞、World Labs提出五张照片即可让机器人适应陌生环境等也值得关注。本文梳理今日8条最值得关注的AI行业动态。
一、Google发布Gemini 3.8 Flash与Flash Cyber:三周迭代,HLE得分54.9%居首
Google于9月3日推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两个新模型。官方称Gemini 3.8为”迄今最强的推理与编程模型”,在软件工程、智能体任务及多步推理方面相较3.7 Flash有显著改进。值得注意的是,该版本距3.7 Flash发布仅三周,且保持相同的入门价格。
| 项目 | 详情 |
|---|---|
| 模型名称 | Gemini 3.8 Flash + Gemini 3.8 Flash Cyber |
| HLE-Verified得分 | 54.9%(Google对比模型中居首) |
| 输入价格 | $0.75/M tokens(与3.7 Flash相同) |
| 输出价格 | $3.75/M tokens(与3.7 Flash相同) |
| 距上代发布 | 仅三周 |
| 核心改进 | 编码、智能体工作流、多步推理 |
| Flash Cyber定位 | 最强网络安全模型 |
| 技术机制 | 利用长时运行智能体循环机制 |
在HLE-Verified评测中,Gemini 3.8 Flash以54.9%的得分领先GPT-5.6 Sol(54.5%)、Claude Opus 5(54.4%)、Gemini 3.7 Flash(53.6%)、GPT-5.6 Terra(51.1%)和Claude Sonnet 5(31.0%)。Google还同步推出了Gemini 3.8 Flash Cyber,定位为最强网络安全模型,专门面向安全领域应用。
二、Meta数小时后迅速回应:Muse Spark 1.3得分62分超越Gemini 3.8 Flash
在Google发布Gemini 3.8 Flash数小时后,Meta随即推出Muse Spark 1.3模型。据Artificial Analysis评测,Muse Spark 1.3得分62分,高于Gemini 3.8 Flash的59分,与Claude Fable 5持平,同时超过GPT-5.6 Sol、Grok 4.6、Kimi K3等模型。更引人注目的是其价格优势。
| 项目 | 详情 |
|---|---|
| 模型名称 | Muse Spark 1.3 |
| Artificial Analysis得分 | 62分(与Claude Fable 5持平) |
| 对比Gemini 3.8 Flash | 62分 vs 59分(高3分) |
| 输出价格 | $0.2/M tokens |
| 对比Claude Opus 5成本 | 降低125倍($0.2 vs $25/M) |
| 输入成本对比Fable 5 | 低约8倍 |
| 输出成本对比Fable 5 | 低近12倍 |
| 工具调用次数 | 较1.2版本减少约20% |
| Token使用量 | 较1.2版本降低25% |
| 可用平台 | Muse Code + Meta Model API |
竞争态势:Meta与Google的模型发布”数小时对决”标志着AI竞争进入白热化。Meta以1/12的价格达到与Claude Fable 5持平的智能水平,价格战正在从OpenAI/Anthropic的主战场蔓延到Meta/Google之间。
三、美国政府首次表态:训练LLM使用版权材料属合理使用
美国政府在一份法律意见书中表态支持OpenAI的立场,主张在版权材料上训练大语言模型(LLM)通常构成合理使用。该意见书虽无法律约束力,但标志着美国政府首次在此关键问题上明确表态,可能对AI行业版权诉讼产生重大影响。
- 表态方:美国政府(法律意见书形式)
- 核心立场:训练LLM使用版权材料通常构成合理使用
- 支持对象:OpenAI
- 法律效力:无法律约束力,但具重要参考价值
- 历史意义:美国政府首次在此问题上明确表态
- 潜在影响:可能对AI行业面临的版权诉讼产生重大影响
此前,多家AI公司面临版权诉讼,包括Sony和Warner起诉Anthropic使用torrent下载版权音乐训练Claude。美国政府的这一表态为AI行业提供了重要的法律支持信号,可能改变版权诉讼的法律格局。
四、OpenAI与Anthropic报告curl零安全问题,AISLE随后发现6个零日漏洞
OpenAI的Codex Security和Anthropic的Mythos均报告在curl代码库中发现0个剩余安全问题。然而,随后AISLE发现了6个新的零日漏洞,这些漏洞已经过curl安全团队的验证,并被分配了CVE编号。这一”6比0″的结果在curl这一全球最严苛的代码库之一上引发了广泛关注。
| 项目 | 详情 |
|---|---|
| 检测方1 | OpenAI Codex Security |
| 检测结果1 | 0个剩余安全问题 |
| 检测方2 | Anthropic Mythos |
| 检测结果2 | 0个剩余安全问题 |
| 检测方3 | AISLE |
| 检测结果3 | 6个新零日漏洞 |
| 验证状态 | 已通过curl安全团队验证,获CVE编号 |
| 核心矛盾 | 两大AI模型报告”零问题” vs AISLE发现6个漏洞 |
安全警示:AI模型在安全审计中的”零发现”并不等于代码库真的没有问题。两个顶级AI模型同时漏检6个零日漏洞,说明AI驱动的安全工具仍有明显的盲区,不能完全替代专业安全审计。
五、World Labs提出机器人学习新概念:五张照片即可适应陌生环境
World Labs联合创始人Justin Johnson在访谈中提出机器人学习的新方向——”完全上下文学习”(fully in-context learning),即通过少量照片(如手机中的五张)即可让机器人在从未见过的房间中工作。这一路径有望大幅降低机器人部署的环境依赖。
- 提出者:Justin Johnson,World Labs联合创始人
- 核心概念:完全上下文学习(fully in-context learning)
- 所需输入:少量照片(如手机中的五张)
- 应用场景:让机器人在从未见过的房间中工作
- 潜在价值:降低机器人部署的环境依赖
- 关联产品:World Labs的Atlas——全球首个多模态世界模型
- Atlas能力:像素级相机控制生成图像和视频帧,重建3D,支持世界建模和时空模拟
六、NVIDIA Omniverse SimReady资产代理进入公开测试,自然语言生成3D资产
NVIDIA在SIGGRAPH 2026上宣布的全球首个SimReady资产代理今日起正式进入公开测试阶段。该代理支持用户通过自然语言生成和迭代3D资产,用户上传参考数据并说明用例后,代理将自动处理后续流程。
- 产品名称:NVIDIA Omniverse SimReady资产代理
- 发布活动:SIGGRAPH 2026
- 当前状态:公开测试阶段
- 核心功能:自然语言生成和迭代3D资产
- 使用流程:上传参考数据 + 说明用例 + 代理自动处理
- 行业意义:全球首个SimReady资产代理,加速3D内容创作
七、NVIDIA GTC 2026欧洲站定于10月柏林举行,聚焦物理AI与机器人
NVIDIA官方发布GTC 2026欧洲站活动预告,会议定于2026年10月21日至22日在柏林举行,其中10月21日为主旨演讲日,10月20日设有研讨会。会议聚焦物理AI与机器人技术,探讨开放模型与仿真技术的最新进展。
| 项目 | 详情 |
|---|---|
| 活动名称 | GTC 2026欧洲站(柏林) |
| 研讨会 | 10月20日 |
| 主旨演讲 | 10月21日 |
| 会议地点 | 德国柏林 |
| 核心主题 | 物理AI与机器人技术 |
| 议程方向 | 工业AI、机器人、自动驾驶 |
| 语言支持 | 英语、德语等多语言 |
| 同期活动 | PyTorchCon 10月20-21日圣何塞 |
八、MIT纪念AI诞生70年公布达特茅斯原始提案,MiniMax免费期限仅剩5天
MIT CSAIL于9月3日发文,纪念人工智能术语诞生70余年,并附上1955年达特茅斯研究提案的原始文件链接。该提案由麦卡锡、明斯基、罗切斯特和香农共同提出,明确了七个研究方向:自动计算机、语言使用、神经元网络、计算规模理论、自我改进、抽象、随机性与创造性。提案核心假设是”智能的各个特征原则上能够被精确描述,并可由机器进行模拟”——70年后的今天,这一假设正在被AI行业一步步验证。
与此同时,MiniMax官方提醒用户,其GMI Cloud平台上的M3、M2.7、Music 3.0和Speech 2.8模型免费使用期限仅剩5天。同时启动MiniMaxathon活动,参与者有机会获得500美元现金、3个月MiniMax token plan max以及200美元GMI credits奖励。
- MIT纪念:AI术语诞生70余年,公布1955年达特茅斯提案原始文件
- 提案作者:麦卡锡、明斯基、罗切斯特、香农
- 七个方向:自动计算机、语言使用、神经元网络、计算规模理论、自我改进、抽象、随机性与创造性
- MiniMax免费期限:M3/M2.7/Music 3.0/Speech 2.8仅剩5天免费
- MiniMaxathon活动:$500现金 + 3个月token plan max + $200 GMI credits
- 同期动态:PyTorch基金会宣布Lablup以白银会员加入,推动开源AI发展
写在最后:今日的AI行业呈现出”速度与密度”的双重特征。Google和Meta在数小时内交替发布新模型,AI竞赛的节奏已经快到以”小时”为单位;Meta以1/12的价格达到与Claude Fable 5持平的智能水平,价格战正在从高端市场蔓延到中端;AI安全领域出现了”两大模型报告零问题vs第三方发现6个漏洞”的尴尬局面,提醒我们AI安全工具仍不能完全替代专业审计;而MIT纪念AI诞生70年的消息,则让我们回望起点——70年前四位先驱提出的七个研究方向,至今仍是AI领域的核心命题。从达特茅斯到Gemini 3.8,从”机器能否思考”到”AI能否自主编程”,技术的飞跃令人惊叹,但核心问题的探索远未结束。
延伸阅读
- 2026年9月2日AI行业资讯速览 — Anthropic发布Fable/Mythos 5.1、李飞飞Atlas世界模型、MiniMax H3实时生成
- 深度测评:Anthropic发布Fable 5.1与Mythos 5.1 — 同一模型双重人格,重定义AI安全范式
- 2026年9月1日AI行业资讯速览 — 工信部培育2000家AI服务商、MiniMax 8亿ARR
- DeepSeek编程Agent选型指南 — 深入了解AI编码智能体的选型与对比
