Gemini 4 Argon发布:100万Token输出,首批只给可信安全团队
BiRun 讯,动察 Beating AI 快讯,Google DeepMind 发布新一代旗舰模型 Gemini 4 Argon。它主打长程复杂任务,覆盖软件工程、金融和法律工作,以及网络安全。模型暂不向普通用户开放,首批只通过 Fairwind Program 提供给可信网络安全团队。后续将逐步开放给付费 API 客户和 Google AI Ultra 用户。
Argon 最大的变化之一是输出长度。单次输出上限从此前的 64K tokens 提高到 100 万 tokens,允许模型在一次任务中持续推理和执行更长的步骤。Google 称,内部已经用它做大规模代码迁移、算法优化和数据中心内存优化。
官方评测中,Argon 在 DeepSWE v1.1 得到 77.9%,高于 GPT-6 Astra 的 74.1% 和 Claude Opus 5.5 的 74.2%;Vals Index 和 AutomationBench 也排名第一。但它没有全面领先,在 FrontierSWE、Terminal-Bench 4.0 和部分科学任务上,仍落后 GPT-6 Astra 或 Claude Opus 5.5。
Google 还重点强化了网络安全能力。Argon 可以自动发现、验证并修补软件漏洞,可信防御团队拿到的版本甚至会取消部分网络安全限制,以释放完整能力。正式开放前,Google 还在继续测试滥用、提示词注入和 Agent 越界等风险。 API 上线初期按每百万输入 tokens 2 美元、输出 10 美元收费,之后价格翻倍至 4 美元和 20 美元。
Argon 最大的变化之一是输出长度。单次输出上限从此前的 64K tokens 提高到 100 万 tokens,允许模型在一次任务中持续推理和执行更长的步骤。Google 称,内部已经用它做大规模代码迁移、算法优化和数据中心内存优化。
官方评测中,Argon 在 DeepSWE v1.1 得到 77.9%,高于 GPT-6 Astra 的 74.1% 和 Claude Opus 5.5 的 74.2%;Vals Index 和 AutomationBench 也排名第一。但它没有全面领先,在 FrontierSWE、Terminal-Bench 4.0 和部分科学任务上,仍落后 GPT-6 Astra 或 Claude Opus 5.5。
Google 还重点强化了网络安全能力。Argon 可以自动发现、验证并修补软件漏洞,可信防御团队拿到的版本甚至会取消部分网络安全限制,以释放完整能力。正式开放前,Google 还在继续测试滥用、提示词注入和 Agent 越界等风险。 API 上线初期按每百万输入 tokens 2 美元、输出 10 美元收费,之后价格翻倍至 4 美元和 20 美元。
评论
0/500
登录 后参与讨论
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯