
各位读者好,今天是2026年10月2日,以下是今日AI行业要闻速览。
Gemini 4 Argon智能指数追平GPT-6 Astra,成本仅为其60%
Artificial Analysis发布数据称,Google新推出的Gemini 4 Argon在Intelligence Index上追平GPT-6 Astra,且在折扣价格下每任务成本仅为后者的60%。Google因此重回智能水平前三的实验室之列。
Gemini 4 Argon是Google DeepMind首个proprietary模型,在保持顶级智能水平的同时具备显著的成本优势。对于追求性价比的企业用户来说,这是一个极具竞争力的选择。
OpenAI GPT-6 Astra Ultrafast在NVIDIA Blackwell GPU上运行,速度最高8倍
NVIDIA宣布,OpenAI的GPT-6 Astra Ultrafast已在NVIDIA Blackwell GPU上运行,并通过OpenAI API及符合条件的ChatGPT Work和Codex用户开放。借助针对Blackwell架构的持续推理优化,Ultrafast模式的token生成速度最高可达Astra标准模式的8倍。
OpenAI推理负责人Philippe Tillet与计算首席技术官Uday Ruddarraju均表示,NVIDIA平台的可编程性及工具链投入帮助实现了Astra Ultrafast背后的加速。开发者已可通过API使用。
Google联合Planet发射原型卫星,搭载四颗TPU入轨
Google宣布与Planet合作,通过SpaceX的Transporter-18拼车任务,将一颗搭载四颗TPU的原型卫星送入轨道。这是Google长期研究登月项目Project Suncatcher的第一步,旨在探索将算力送入太空的可行性。
Sundar Pichai回顾了团队首次提出”将算力送入太空”构想的会议,称其为令人兴奋的想法。TPU在轨运行是Google在太空计算领域的重要探索。
Google DeepMind发布SynthID Bio,为AI设计蛋白质嵌入水印
Sundar Pichai宣布,SynthID Bio作为面向AI生成生物设计的新型水印方法家族,是科学诚信与生物安全领域的重大进展。该技术在全球范围内首次实现将不可感知的签名直接嵌入蛋白质序列,且不影响其生物功能。
随着AI设计蛋白质能力的快速发展,生物安全问题日益受到重视。SynthID Bio为AI生成生物材料提供了可追溯机制,有助于防止滥用。
Perplexity发布pplx-decider-v1-27b决策模型,11项基准总分85.71%
Perplexity在Hugging Face发布基于Qwen3.8-27B微调的决策模型pplx-decider-v1-27b,并通过Perplexity API在11项基准上测量准确率。该模型总分85.71%,优于Jev(84.51%)和原始Qwen3.8-27B(74.76%)。
在FinancialPhraseBank(84.18%)、RAGTruth(88.80%)、TabFact(90.60%)、Circa(89.20%)等任务上表现最佳。使用该模型需Python 3.12+及可容纳约49 GiB权重的CUDA GPU,支持choice与noul类型及图像输入。决策模型赛道竞争正日趋激烈。
Meta Muse Spark 1.1/1.2/1.3登顶ProgramBench
Meta Muse Spark 1.1/1.2/1.3已在ProgramBench(PB)上发布。在PB中,SWE-agent需从零编写完整程序,例如sqlite、ffmpeg、php。其中Muse Spark 1.3以极高的成本层级在总榜取得第2名(max)和第3名(xhigh)。
发布者称其为”智能便宜到无法计量(Intelligence too cheap to meter)”的典范。在需要从零构建完整程序的硬核编程基准上取得佳绩,说明Muse Spark系列在复杂软件工程任务上具备强大能力。
Meta在Connect 2026发布智能眼镜,目标年底达100款设计
Meta在Connect 2026上宣布推出智能眼镜,售价区间为249美元至1299美元,并计划在年底前实现100款设计。IDC 2026年第二季度数据显示,轻薄型眼镜占XR眼镜与头显出货量的70.3%,Meta在XR眼镜与头显市场占有68.7%的份额。
智能眼镜正成为AI硬件的重要形态,Meta通过丰富的设计款式覆盖不同用户群体,加速AR设备的大众化进程。
Mustafa Suleyman推出实时转录模型,速度提升55%、成本降60%
Mustafa Suleyman宣布推出一款实时转录模型,并声称其为全球最准确、排名第一。据其表述,该模型比ElevenLabs快55%、成本低60%,同时邀请开发者在其平台上构建Agent。Satya Nadella转发了该推文。
实时语音转录是AI语音交互的核心环节,更低的延迟和成本将推动实时语音应用的大规模落地。
其他重要资讯
- AFederation开放Ptarmigan-1:无结构AI药物发现模型,不构建蛋白质3D结构即可预测小分子与蛋白质结合。
- Isomorphic Labs:潜在药物化学搜索空间接近10^60,AI药物发现潜力巨大。
- MiniMax H3实现30秒连续视频生成:在MachGen平台突破原生15秒限制,单一不中断视觉序列。
- Cursor上线GLM 5.3与GLM 5.3 Flash:GLM 5.3 Max是CursorBench 4.0上得分最高的开源权重模型。
- PyTorch发布Jagged Flash Attention:Meta生成式广告模型(GEM)背后的注意力内核,基于Blackwell和TLX构建。
- NVIDIA祝贺CoreWeave RL Rollouts进展:推出CoreWeave Forge,解决RL后训练中的GPU等待问题。
- Preload发布机器人数据采集方案:同步采集自我中心视频、EMG肌电信号与触觉数据,服务VLA和世界模型。
- LeCun转发讨论:LeWM按时间步应用SIGReg或致时间坍缩,建议在(N*T, D)张量上应用。
- MiniMax出席AI Engineer NYC:Morgan Suo演讲”更快模型的隐性成本”,探讨量化、投机解码与推理控制。
- UNESCO与牛津大学推出言论自由MOOC:10月5日上线,聚焦言论自由国际标准及安全。
以上就是今天的AI行业资讯速览,感谢阅读!如需了解更多AI行业动态,欢迎持续关注我们的频道。
