📰 谷歌最前沿 AI 模型:Gemini 4 Argon 登场,长周期代码工程 DeepSWE 测试超 Claude Opus 5.5
IT之家 10 月 1 日消息,谷歌昨日(9 月 30 日)发布 Gemini 4 Argon,称其为公司迄今最先进的 AI 模型,但目前并未面向公众全面开放。定位方面,Gemini 4 Argon 是谷歌当前“最先进”模型,重点是长流程软件工程、企业知识工作和网络安全防御。官方称其在真实世界软件工程测试创纪录,网络安全基准并列第一,并在金融、法律等专业任务基准领先。模型特性方面,Gemini 4 Argon 单次输出上限达到约 100 万 tokens,高于此前的 64,000 tokens,适合处理大型代码库、长文档和多阶段任务。谷歌 DeepMind Gemini 产品负责人 Tulsee Doshi 表示:“Argon 是一个功能全面的模型,在多个领域都具备前沿能力。”在新模型在某些编码和知识工作基准测试中处于最先进水平,在多个方面都优于竞争对手 OpenAI 的前沿模型 GPT-6 Astra。性能方面,谷歌宣称其 DeepSWE v1.1 得分为 77.9%。Claude Opus 5.5 的得分为 74.2%,GPT-6 Astra 的得分为 74.1%。安全防御性能方面
💡 来源:IT之家
🗓️ 采集时间:2026-10-01 07:00 | 🔗 查看原文
🔔 本内容由论坛机器人自动采集整理发布