
8月25日,AI行业迎来多个重磅消息。英伟达宣布Groq 3 LPX推理加速器全面量产,SpaceXAI将Vera Rubin算力延伸至太空;小鹏机器人首轮融资超9亿美元,估值63亿美元刷新中国具身智能纪录;OpenAI再次下调GPT-5.6 Sol价格,一个月内第二次降价。此外,英伟达洽谈投资Perplexity、Meta计划推出Hatch AI助手等也值得关注。本文梳理今日8条最值得关注的AI行业动态。
一、英伟达Groq 3 LPX全面量产,推理加速再上新台阶
英伟达8月25日宣布,其交互式AI推理加速器NVIDIA Groq 3 LPX现已全面量产。作为NVIDIA Vera Rubin平台的延伸,Groq 3 LPX通过为高响应智能体系统实现超快速的令牌生成,显著提升了AI推理能力。
- 产品定位:交互式AI推理加速器,面向高响应智能体系统
- 所属平台:Vera Rubin平台延伸产品线
- 核心优势:超快速令牌生成,显著降低推理延迟
- 目标场景:AI智能体、实时推理、低延迟交互应用
- 量产状态:8月25日宣布全面投产
产业意义:推理芯片正成为AI算力竞争的新战场,随着智能体应用爆发,低延迟高吞吐的推理需求急剧增长。
二、SpaceXAI部署Vera CPU,算力计划延伸至太空轨道
SpaceXAI正在部署NVIDIA Vera,这是首款专为AI智能体打造的CPU,用于支撑下一代智能体AI工作负载。Vera专为处理模型推理过程中的CPU密集型任务而设计,涵盖工具编排、代码执行和数据处理等方面。与此同时,SpaceXAI还计划将算力延伸至太空,首代Starmind AI卫星将基于优化的Vera Rubin NVL72系统。
| 项目 | 详情 |
|---|---|
| Vera CPU | 首款专为AI智能体打造的CPU,处理工具编排/代码执行/数据处理 |
| 部署目标 | 从吉瓦级AI工厂到边缘场景 |
| 太空计划 | Starmind AI卫星,基于Vera Rubin NVL72优化版 |
| 2026年底目标 | 部署超2吉瓦算力 |
| 2027年底目标 | 约10吉瓦算力(地面+轨道) |
| 合作客户 | NYSE、Anthropic、OpenAI、字节跳动等 |
太空算力的核心逻辑在于:Vera Rubin架构在每瓦token数和推理成本方面的改进,在太空环境中尤为重要——轨道上的电力和冷却资源极其宝贵。SpaceXAI计划2027年第四季度将Vera Rubin AI超级计算机送入轨道,这可能开启太空AI推理的新纪元。
三、小鹏机器人首轮融资超9亿美元,估值63亿美元刷新纪录
8月24日,小鹏集团宣布旗下人形机器人业务完成首轮融资,融资金额超9亿美元,投后估值超63亿美元(约430亿元人民币),刷新中国具身智能行业单轮私募股权融资纪录。本轮融资由IDG资本领投,高榕创投参投,腾讯和阿里巴巴两大互联网巨头同时参投。
| 项目 | 数据 |
|---|---|
| 融资金额 | 超9亿美元 |
| 投后估值 | 超63亿美元(约430亿元人民币) |
| 行业地位 | 刷新中国具身智能单轮私募融资纪录 |
| 领投方 | IDG资本 |
| 参投方 | 高榕创投、腾讯、阿里巴巴 |
| 控股方 | 小鹏集团继续控股机器人业务 |
资本风向标:腾讯和阿里同时参投同一家人形机器人公司,凸显中国互联网巨头对具身智能赛道的战略重视。
四、OpenAI再次下调GPT-5.6 Sol价格,一个月内第二次降价
OpenAI宣布下调GPT-5.6 Sol API定价,新促销价格自2026年8月25日起生效。调整后,输入每1M tokens价格降至4美元(降幅20%),输出每1M tokens价格降至20美元(降幅33%)。该促销定价将至少维持至2026年11月21日。这是GPT-5.6系列不到一个月内的第二次降价。
| 模型 | 原价(输入/输出) | 促销价(输入/输出) | 降幅 |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 / $30.00 | $4.00 / $20.00 | 输入-20%,输出-33% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
美国头部AI大模型接连降价,引发市场对价格战的担忧。从7月底Luna降价80%,到8月Sol再降33%,OpenAI正以激进定价策略应对竞争压力。模型价格的快速下行为AI应用层创业公司带来了成本红利,但也压缩了整个行业的利润空间。
五、英伟达洽谈投资Perplexity,估值或超300亿美元
据The Information报道,英伟达正与AI搜索初创公司Perplexity洽谈投资事宜,该轮股权融资对Perplexity的估值可能超过300亿美元。在投资洽谈之前,英伟达曾考虑向Perplexity支付数十亿美元,以获得其部分技术授权并聘用部分员工。目前双方谈判仍在进行中。
- 潜在估值:超300亿美元
- 投资方:英伟达
- 谈判状态
:进行中,具体金额和条款未披露 - 前期接触:英伟达曾考虑支付数十亿美元获取技术授权+聘用员工
- 战略逻辑:英伟达持续布局AI应用层,强化生态话语权
六、Meta计划推出Hatch AI助手平台,10月发布Watermelon模型
据报道,Meta Platforms计划最早在未来几周内推出其面向消费者的AI助手(内部代号为Hatch),并计划于10月推出其最新AI模型”Watermelon”。Hatch是Meta CEO扎克伯格雄心壮志的一部分,旨在将公司巨额的AI投资变现,并拓展广告以外的多元化收入来源。
竞争格局:Meta正从开源模型提供商向消费级AI产品运营商转型,直接与OpenAI、Anthropic在C端市场竞争。
- 产品代号:Hatch(OpenClaw消费者AI助手)
- 推出时间:最早未来几周内
- 新模型:Watermelon,计划10月发布
- 战略目标:AI投资变现,拓展广告外收入
- CEO定位:扎克伯格AI战略的核心组成部分
七、NVIDIA Sol Engine加速MiniMax H3,视频生成提速27倍
MiniMax AI宣布,其与NVIDIA SANA团队合作的Sol Engine在MiniMax H3模型上实现重大加速。通过将生成过程拆分为4步低分辨率H3草稿和3步目标分辨率LTX细化(采用Sol-Attn),在单个NVIDIA GB200上,10秒768p视频生成延迟从414秒降至14.93秒。
| 视频规格 | 基线延迟 | Sol Engine延迟 | 加速倍数 |
|---|---|---|---|
| 5秒视频 | 152.3秒 | 6.85秒 | 22.2倍 |
| 10秒768p视频 | 414秒 | 14.93秒 | 27.7倍 |
这一成果远超此前3-4倍的优化水平,标志着AI视频生成效率取得突破性进展。视频生成速度的大幅提升将显著降低内容创作成本,推动短视频、广告、游戏等领域的AI应用普及。
八、Vetta框架长周期Agent任务成本降至Claude Code三分之一
Vetta是一个面向长周期Agent任务的高效框架,据其官方数据,在相同模型与任务条件下,仅更换框架即可显著降低任务完成成本。Vetta完成单个任务的成本为0.298美元,而claude-code为0.872美元,hermes为1.095美元。该框架不仅成本最低,还宣称拥有最高的任务完成率。
| 框架/工具 | 单任务成本 | 对比 |
|---|---|---|
| Vetta | $0.298 | 最低成本+最高完成率 |
| Claude Code | $0.872 | 约为Vetta的2.9倍 |
| Hermes | $1.095 | 约为Vetta的3.7倍 |
这一数据凸显了框架本身对Agent性能与成本的重要影响。在AI智能体应用快速发展的今天,除了模型本身的能力,框架的效率优化同样是决定成本和体验的关键因素。
写在最后:今日AI行业动态呈现出”算力向上、应用下沉、价格下行”的三重趋势。英伟达Groq 3量产和SpaceX太空算力计划,标志着AI算力基础设施正在向更高性能、更广维度拓展;小鹏机器人9亿美元融资和Meta Hatch平台,则显示AI应用正从软件向硬件、从B端向C端加速渗透;而OpenAI的持续降价和Vetta框架的成本优化,则预示着AI服务的性价比正在快速提升。算力、模型、应用三层协同演进,AI产业的整体格局正在加速重塑。
延伸阅读
- 2026年8月24日AI行业资讯速览 — 了解昨日AI行业动态,保持信息连续性
- 2026年8月23日AI行业资讯速览 — 回顾本周AI行业热点事件
- Seedance 2.5深度测评:配合火山剧创,AI短剧工业化走到了哪一步 — 了解AI视频生成领域的最新进展
- DeepSeek Harness深度测评 — 了解AI Agent框架的技术架构与成本优化
