Gemini 4 Argon 是 Google DeepMind 最新的前沿模型,面向软件工程、法律金融等复杂工作流提供深度推理能力。模型支持行业领先的 1 百万 token 上下文长度,相比之前的 64 K token 可在单次推理中生成数十万 token,显著提升长时序问题的解决深度。
在内部使用中,Argon 已帮助量子算法优化将关键子程序的时空资源提升 40%,通过分析全网监控数据在数据中心释放超过 300 TiB 内存,并在 Fuchsia Zircon 内核等项目中将数十万行 C/C++ 代码迁移至 Rust,单个库的 SIMD 重写后实现 2.7 倍加速且保持安全性。
模型在多项基准上居首:DeepSWE v1.1 达到 77.9% 的长程软件工程得分,Vals Index 在金融、法律、税务等对美国 GDP 贡献权重下领先,AutomationBench 评分 51.3%,LVBench 视频理解得分 91.7%。在安全领域,Argon 能自主发现、验证并修补漏洞,在 CWE‑bench v1 中取得 68% 的最高分,并在 Wiz 的 Scan for Good 项目中成功定位全球医院软件的敏感信息泄露。
安全防护方面,Google 采用四大措施:防止滥用并拒绝 CBRN 攻击请求;通过红队和对抗训练提升对间接提示注入的鲁棒性;监控链式思考以阻止误对齐行为;在沙箱环境中硬化系统并共享最佳实践。当前模型通过 Fairwind 计划向受信任的网络防御者开放,API 计费为每百万输入 token 2 美元、输出 token 10 美元,缓存输入 token 享受 95% 折扣。
Gemini 4 Argon 旨在成为开发者、专业人士和企业的伙伴,帮助他们攻克最具挑战的问题。我们将继续收集早期测试反馈,完善防护后向付费 API 客户和 Google AI Ultra 订阅者全面发布。
点评