Google 已发布其期待已久的模型 Gemini 4 Argon。该模型目前已通过 Fairwind Program 向一批“受信任的网络防御人员”和测试人员开放。

在一篇博客文章中,Google DeepMind 高级副总裁兼 Google 首席 AI 架构师 Koray Kavukcuoglu 于周三表示,该模型旨在应对复杂的长期工作流,并在其中持续进行深度推理。

Kavukcuoglu 表示:“它在复杂工作流中展现出前沿性能,适用于现实世界的软件工程、法律和金融等企业知识工作,以及网络安全防御。”

这款新模型将分阶段推出。该团队表示,将继续收集早期测试人员的反馈,以反复改进安全防护措施。

Kavukcuoglu 表示:“要安全地发布这一水平的前沿能力,需要采取分阶段的方法。我们正在积极参与美国政府关于预发布模型访问的自愿流程,同时逐步扩大访问范围。”

据该文章介绍,Gemini 4 Argon 模型预计将以每百万输入 tokens 2 美元、每百万输出 tokens 10 美元的初始价格推出。缓存的输入 tokens 价格将在输入 tokens 价格基础上优惠 95%。

能力增强

据该文章介绍,这款新模型的输出上限已从此前的 64,000 tokens 提升至 1 million tokens。

Kavukcuoglu 表示:“当模型拥有充足的思考空间,能够在单次推理轨迹中生成数十万 tokens 时,它就能进一步提升推理深度,一次性解决棘手问题。”

Kavukcuoglu 指出,Google 工程师一直在日常工作中使用 Argon,包括调试、代码库迁移和算法设计。

不过,彭博社周三报道称,一些内部工程师对此持怀疑态度。他们表示,Gemini 4 在用于评估模型效能的基准测试中表现良好,但员工实际使用时效果却不那么理想。

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

更强的知识工作与安全能力

Google 还强调了新模型的视觉理解能力。Kavukcuoglu 表示,它可以驱动图表分析、识别视频细节,并根据一系列文档采取行动。

Kavukcuoglu 表示,该模型“具备很强的网络安全防御能力”,能够自主识别、验证并修补软件漏洞。

例如,安全公司 Wiz 已经在使用 Argon 进行网络安全防御。Google 表示,该模型发现了一个漏洞,该漏洞会导致全球各地医院使用的医疗软件中的敏感个人数据暴露。

该团队还表示,这款模型旨在“拒绝有害请求”,以防止不法分子利用它发动攻击。

Kavukcuoglu 补充说:“这些安全防护措施已经接受了内部和外部红队的稳健性测试,测试结合了人工和自动化攻击方法。”