← 所有文章

Gemini 4 Argon:新型号Google DeepMind

明亮的工作室配有浮动水晶和柔和的光节点网络

2026年9月30日,Google DeepMind发布了Gemini家族的全新前沿车型Gemini 4 Argon。它正在通过 Fairwind Program 计划向一小群值得信赖的网络安全专业人士推出,该公司承诺稍后进行更广泛的发布:首先针对开发人员、公司和消费者,从付费 API 用户和 Google AI Ultra 订阅者开始。

模型一次性解决的长多步问题的方案

Gemini 4 Argon能做什么?

该公告列出了该模型显示出强劲成果的三个关键领域:

  • 编程。 该模型适用于实际的工程问题 - 从日常调试到大型代码库迁移。谷歌表示,Argon 已经更新了 DeepSWE v1.1 基准测试的最高分(77.9%),该基准测试衡量现实世界开发中长期、多步骤任务的性能。
  • 企业知识工作。 说到法律和金融,Argon 是 Vals Index 的领先者,该指数衡量这些领域的经济影响,并在 Vals Finance Agent v2(多步骤金融研究)和 Harvey's Legal Agent Benchmark(法律研究和文件准备)方面显示出领先的成果。在 Zapier 衡量业务任务端到端执行情况的 AutomationBench 上,该模型以 51.3% 的得分排名第一。
  • 网络安全保护。 Argon 经过训练可以自主查找、测试和修补漏洞。在评估漏洞消除情况的 CWE-bench v1 基准测试中,该模型以 68% 的成绩并列第一。该模型提供给值得信赖的防御者和谷歌内部团队,没有“网络限制器”,以便充分发挥其保护潜力。

特别强调处理视觉信息:该模型解析专业图表,在长视频中查找细节并对一系列文档进行操作。在衡量长视频理解能力的 LVBench 基准测试中,Argon 取得了 91.7% 的分数。

建筑:什么被揭示,什么没有被揭示

公告中Google DeepMind没有透露Gemini 4 Argon的技术架构——既没有参数数量,也没有层结构,也没有训练数据。该公司通过其行为来描述该模型:在漫长的多步骤工作流程中进行深度推理的能力。因此,我们不提供具体的架构细节 - 它们不在官方来源中,并且我们不会发明模型的设计。

提款限额 - 100 万个代币

官方的主要变化之一是提现限额从之前的 6.4 万个扩大到 100 万个。当模型有足够的空间进行深入思考并在单个轨迹中生成数十万个令牌时,它可以一次性解决复杂的问题。这是长期多步骤任务的规定赌注。

谷歌内部如何使用氩气

公司提供内部使用的具体例子:

  • 量子算法。 Argon 帮助研究人员优化例程的资源(量子位 × 门)。在一个示例中,该模型在几分钟内就比已发布的基线高出 40%。
  • 节省内存。 Argon 上的代理对整个服务器群进行了分析并进行了内存优化,推出后释放了超过 300 TiB - 估计总共释放了 500 TiB 到 1 PiB。
  • 代码迁移。 Argon 代理将代码库从 C/C++ 翻译为 Rust - 从 re2 和 libgav1 等库中的数万行到 Fuchsia Zircon 内核的 80 多万行。对于 libgav1,代理替换了 32000 行 SIMD 代码,并获得了安全视频解码器,其工作速度比具有相同视频的 Rust 端口快 2.7 倍。

广泛发布前的安全性

在大规模发布之前,谷歌正在加强其保护机制。该模型必须拒绝危险请求(网络威胁以及化学、生物、放射性和核情景),同时保持合法的科学目标。对间接注入提示的抵制单独声明:根据灰天鹅 IPI 基准,Argon 处于领先地位。另一个方向是控制与用户意图的偏差:系统监控模型的推理和动作链,并在必要时停止执行。

价格和访问权限

Google 指定了推出期的起始价格:100 万个输入代币 2 美元,100 万个输出代币 10 美元,缓存输入代币比入门价格有 95% 的折扣。推出期结束后,100 万个输入代币的价格为 4 美元,100 万个输出代币的价格为 20 美元。发布时还没有公开访问权限:只有受信任的测试者和维护者才能收到该模型,因此给出了未来商业发布的价格。

从Gemini 4 Argon到NeuralSpace是多少

该模型尚未出现在我们的网站上 - 任何地方都无法公开访问它。我们正在监控发布情况,并会在情况发生变化时通知您。同时在 聊天 和部分 “代码” 您可以使用其他当前模型。