**谷歌发布 Gemini 4 Argon:长周期代码工程测试超越 Claude Opus 5.5**

_谷歌最前沿 AI 模型:Gemini 4 Argon 登场,长周期代码工程 DeepSWE 测试超 Claude Opus 5.5_

> 谷歌于 9 月 30 日发布其迄今最先进的 AI 模型 Gemini 4 Argon,目前未向公众全面开放。该模型单次输出上限提升至约 100 万 tokens,重点优化长流程软件工程、企业知识工作及网络安全防御。在 DeepSWE v1.1 长周期真实软件工程测试中,Gemini 4 Argon 以 77.9% 的得分位居第一,领先于 Claude Opus 5.5(74.2%)和 GPT-6 Astra(74.1%)。此外,其在网络安全基准 CWE-bench v1 中以 68% 的最高分并列第一,并在金融、法律等专业任务基准中表现领先。

**来源信息**
- **来源**:IT之家(RSS)
- **分类**:ai-models
- **发布时间**:2026-10-01 06:57(北京时间)
- **原文**:[打开原文](https://www.ithome.com/1/008/953.htm)