谷歌发布Gemini 4 Argon前沿模型
IT时代网10月1日消息,谷歌发布新一代旗舰模型 Gemini 4 Argon,官方把这一代描述为“前沿智能的新阶段”,主打复杂长周期工作流中的深度推理,并启用新的模型命名方式。
Gemini 4 Argon 的输出 token 上限从上一代的 6.4 万提升到 100 万,配合扩展后的编码、推理与多模态能力,用于一次生成数十万 token、一次性解决复杂问题的场景。
官方公布的基准成绩显示,该模型在 DeepSWE v1.1 上得分 77.9%,高于 Claude Opus 5.5 的 74.2% 与 GPT-6 Astra 的 74.1%;在评估漏洞修复能力的 CWE-bench v1 上以 68% 并列第一;在 Zapier 的 AutomationBench 上以 51.3% 排名第一;衡量长视频理解的 LVBench 上以 91.7% 取得最好成绩。金融研究与法律检索等专业评测中,它也拿到领先结果。
谷歌称 Gemini 4 Argon 在网络安全防御方向经过专门训练,相比 3.8 Flash Cyber 有明显提升,并以“不设网络护栏”的方式提供给可信防御者与谷歌内部团队,用于发挥其完整的前沿防御能力。该模型将分阶段推出,先面向 Google AI Ultra 订阅用户与付费 API 客户。
在谷歌内部,该模型已经开始承担实际工作:一组 Argon 智能体分析全公司数据中心的性能分析数据,自主定位并应用内存优化,全面铺开后释放了超过 300TiB 内存,预计节省总量在 500TiB 至 1PiB 之间;它还被用于把 C/C++ 代码库迁移到 Rust,涉及 Fuchsia OS 的 Zircon 内核等超过 80 万行的项目。在开源视频解码器 libgav1 上,智能体替换了 3.2 万行 SIMD 代码,最终得到一个内存安全、比原 Rust 移植版快 2.7 倍的解码器。
谷歌同时公布了发布前的安全措施,包括监控模型内部激活以识别网络与生化核等滥用风险、强化对间接提示注入的抵抗力、隔离高风险训练与评测环境,以及对模型的思维链与动作进行失配监控。此前,本站曾报道过谷歌确认 Gemini 4 即将推出。

编辑:林一舟