产品简介
Google Gemini 4 Argon 是 Google DeepMind 于 2026 年 9 月 30 日发布的前沿模型,也是 Gemini 4 系列首款产品,由 DeepMind SVP 兼 Google 首席 AI 架构师 Koray Kavukcuoglu 撰文公布。这是谷歌近七个月来首款超越 Flash 级别的前沿专有模型,此前多次跳票的 Gemini 3.5 Pro 已确认取消发布。Argon 面向长程复杂工作流的深度推理,重点覆盖真实世界软件工程、法律与金融等企业知识工作、网络安全防御与创意写作。其输出 token 上限从上一代 Gemini 的 64K 提升到 100 万,单次响应可承载大规模代码迁移这类长输出任务。在经历 Gemini 3.5 Pro 夭折、DeepMind 领导层调整与人才流失的背景下,Argon 被视作谷歌对掉队叙事的回应,也是其从强调前沿能力转向强调性价比的落地产品。
核心功能
- 百万级输出 token:输出 token 上限从上一代 Gemini 的 64K 提升到 1M(100 万),单次响应可承载大规模代码迁移这类长输出任务。
- 长程软件工程能力:在 DeepSWE v1.1 长周期软件工程基准上得分 77.9%,官方公布对比中高于 GPT-6 Astra 的 74.1%、Claude Opus 5.5 的 74.2% 与 Claude Fable 5.1 的 67.4%。
- 企业知识工作与业务执行:在 Zapier AutomationBench 端到端业务执行上得分 51.3%,高于 Astra 的 41.4%、Opus 5.5 的 42.5% 与 Fable 5.1 的 31.4%;Harvey 法律代理基准 19.6%,约为第二名的三倍;Vals Finance Agent v2 金融代理 65.4%,超过 Claude Opus 5.5 与 GPT-6 Astra。
- 网络安全防御与漏洞修复:CWE-bench v1 漏洞修复得分 68%,与 GPT-6 Astra 并列第一;先通过 Fairwind 计划向政府、关键基础设施运营商与核心技术平台等可信网络防御者开放,该版本不带网络安全护栏,公开版本保留对网络与 CBRN 攻击的拒答。
- 长视频理解与创意写作:LVBench 长视频理解得分 91.7%;官方将创意写作列为重点场景之一。
- 第三方评测表现:独立机构 Artificial Analysis 的智能指数 Argon 得 53 分,与 GPT-6 Astra 持平,进入智能前三梯队;Arena.ai 的 Text Arena 榜单以 1525 分登顶;Arena 的 Agent Arena 上 Argon (High) 位列第 8,净提升 7.92%。
适合谁用
以下类型的用户会特别受益于 Google Gemini 4 Argon:
- 长程软件工程:用于调试、最多 80 万行以上的 C/C++ 到 Rust 代码库迁移与算法设计。
- 企业知识工作:法律代理、金融代理与端到端业务执行等场景。
- 网络安全防御:通过 Fairwind 计划向可信网络防御者开放,Wiz 已在 Scan for Good 项目中用 Argon 扫描公共基础设施。
- 长视频理解:在 LVBench 长视频理解基准上得分 91.7%。
- 创意写作:官方列出的重点场景之一。
优点亮点
- 输出 token 上限从 64K 提升到 100 万,单次响应可承载大规模代码迁移这类长输出任务。
- 官方公布的 18 项对比中 12 项领先、1 项并列第一,覆盖长周期软件工程、端到端业务执行、法律代理、金融代理与漏洞修复等场景。
- 在 Vals Index(按美国各行业 GDP 占比加权)上领先。
- 第三方评测中,Artificial Analysis 智能指数得 53 分,与 GPT-6 Astra 持平,进入智能前三梯队;Arena.ai 的 Text Arena 榜单以 1525 分登顶。
- 内部使用成效显著:Google 工程师已将其用于调试、最多 80 万行以上的 C/C++ 到 Rust 代码库迁移与算法设计;Argon 智能体通过发现优化点释放了数据中心 300 TiB 内存,其中一个智能体重写的视频解码组件比原有 Rust 版本快 2.7 倍。
- 定价具备性价比:introductory 价每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入 token 优惠 95%。
价格与方案
introductory 价每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入 token 优惠 95%;introductory 期结束后恢复为每百万输入 4 美元、输出 20 美元。未提供的定价信息以官网为准。
总结与建议
Google Gemini 4 Argon 是 Google DeepMind 于 2026 年 9 月 30 日发布的前沿模型,Gemini 4 系列首款,输出 token 上限从 64K 提升到 100 万,主打长程软件工程、法律与金融等企业知识工作、网络安全防御与创意写作。官方公布的 18 项对比中 12 项领先、1 项并列第一,第三方评测中进入智能前三梯队并在 Text Arena 登顶。先通过 Fairwind 计划向可信网络防御者开放,随后面向付费 API 客户与 Google AI Ultra 订阅用户开放。
版本演进
- Gemini 4 Argon 发布 (2026-09-30):Google DeepMind 发布 Gemini 4 系列首款前沿模型 Argon,输出 token 上限从 64K 提升到 100 万,面向长程软件工程、法律金融等企业知识工作与网络安全防御;官方 18 项对比中 12 项领先,DeepSWE v1.1 拿 77.9%、Zapier AutomationBench 51.3%、LVBench 91.7%,CWE-bench v1 与 GPT-6 Astra 并列第一。introductory 价每百万输入 2 美元、输出 10 美元,缓存输入优惠 95%,之后恢复 4 美元 / 20 美元;先经 Fairwind 计划向可信网络防御者开放,再面向付费 API 与 Google AI Ultra 订阅用户