深度测评:Anthropic发布Fable 5.1与Mythos 5.1——同一模型的双重人格,重定义AI安全范式
2026年9月1日,Anthropic发布了Claude Fable 5.1和Claude Mythos 5.…
Claude Sonnet 5深度测评:Anthropic的”执行者”模型,Agent能力下放中端价位
2026年6月30日,Anthropic 正式发布 Claude Sonnet 5(代号 Fennec)。官方…
2026年下半年AI大模型发布前瞻:DeepSeek V4.1、GPT-5.6、Gemini 3.5,谁将改变游戏规则?
2026年下半年AI大模型发布前瞻:DeepSeek V4.1、GPT-5.6、Gemini 3.5,谁将改变…
Claude Opus 4.8深度测评:Agent能力全面领先,诚实性提升四倍,9650亿估值的底气
Anthropic旗舰模型Claude Opus 4.8深度测评:SWE-Bench Pro达69.2%,Terminal-Bench提升8.5%,诚实性错误率降低四倍。动态工作流、
Claude Opus 4.8刚发布就翻车:追问身份时自称DeepSeek和Qwen,Anthropic陷入双标争议
Claude Opus 4.8发布当天被网友发现,通过API询问时会自称DeepSeek或Qwen而非Claude。
