- Published on
Gemini 4 Argon:谷歌前沿模型开启智能新纪元,聚焦编码、企业知识与网络安全
- Authors
- Name
- bradleyg223
- blog.google

引言
2026年9月30日,谷歌DeepMind正式发布其新一代前沿模型——Gemini 4 Argon。该模型专为复杂、长周期的专业任务设计,在真实世界软件工程、企业知识工作(如法律与金融)以及网络安全防御领域均展现出前沿性能。谷歌采取分阶段发布策略,首先通过Fairwind计划向可信的网络安全防御者开放,并在广泛发布前持续收集反馈、强化安全护栏。
核心能力:超长上下文与深度推理
Gemini 4 Argon拥有业界领先的100万token输出限制(此前为64K token),使其能够在单次推理中生成数十万token,从而对复杂问题进行深度、多步骤的推理。这种“思考空间”让模型能够一次性解决以往需要多次交互的难题。模型同时支持多模态输入(图像、视频、文档),能够进行专业图表分析、长视频细节识别,并基于一系列文档采取行动。
内部应用:重塑谷歌工作流程
Gemini 4 Argon已在谷歌内部广泛使用,数千名员工利用其进行专业编码、深度研究和高质量写作。以下为几个关键案例:
量子算法优化
在量子计算研究中,Argon帮助优化了子程序所需的时空资源(量子比特×门操作)。在一个案例中,它在几分钟内将已发表的基线性能提升了40%。
内存效率提升
一组Argon智能体分析全集群性能遥测数据,自主识别并应用内存优化措施。部署后释放了超过300 TiB的内存,预计总节省量可达500 TiB至1 PiB。
大规模代码库迁移与优化
Argon智能体正在将谷歌内部的C/C++代码库迁移至Rust,涉及核心库(如re2、libgav1)数万行代码,以及Fuchsia Zircon内核超过80万行代码。对于libgav1(谷歌开源视频解码器),Argon智能体通过多轮配置引导实验、研究编译器输出,生成了安全的Rust代码,使编译器自动向量化,最终得到的内存安全视频解码器运行速度比原Rust移植版本快2.7倍,且输出视频完全相同,接近优化后的C++性能。
基准测试:多项第一
Gemini 4 Argon在多个权威基准测试中取得领先成绩:
- DeepSWE v1.1(真实世界长周期软件工程任务):得分77.9%,创下新纪录。
- Vals Index(衡量金融、编码、法律、税务等领域的经济影响,按GDP权重加权):领先所有模型。
- Vals Finance Agent v2(多步骤金融研究):领先。
- Harvey Legal Agent Benchmark(法律研究与起草):领先。
- AutomationBench(Zapier的端到端业务功能执行基准):得分51.3%,排名第一。
- LVBench(长视频理解):得分91.7%,达到最先进水平。
网络安全防御:自主漏洞发现与修复
Gemini 4 Argon在网络安全防御方面经过专门训练,能够自主发现、验证并修补关键软件漏洞。对于可信防御者及谷歌内部团队,谷歌将发布不带网络安全护栏的版本,使其能够充分利用前沿防御能力。
与Wiz的合作案例
云安全公司Wiz通过其“Scan for Good”计划使用Argon保护关键公共基础设施。在一次早期演示中,Argon发现了一个暴露全球医院所用医疗软件中敏感个人信息的严重漏洞,而此前的前沿模型均未能识别。
基准测试表现
- CWE-bench v1(评估模型修复安全漏洞的能力):得分68%,并列第一。
- 在谷歌内部综合漏洞基准测试中,Argon在涵盖20种编程语言的复杂代码库中发现了广泛的安全暴露。
- 在Wiz的内部黑盒渗透测试基准(测试模型无需源代码分析实时Web系统的能力)中,Argon在发现攻击面、识别漏洞并生成概念验证证据方面均优于3.8 Flash Cyber。
前沿安全防护:四重保障
在广泛发布前,谷歌从四个方面加强了安全措施:
- 防止滥用:模型被设计为拒绝有害请求(如网络攻击或CBRN攻击),同时保留合法的双重用途科学研究。通过监控模型内部激活状态来检测滥用,并经过内部和外部红队的鲁棒性测试。
- 防止提示注入攻击:Argon对间接提示注入(恶意指令或上下文劫持模型行为)具有最强韧性。通过自动化红队对抗训练,在Gray Swan的间接提示注入基准上领先。
- 监控对齐性:部署对齐性缓解措施,监控Argon的思维链和行动,必要时停止执行。谷歌强调保持推理透明度,以便识别和诊断对齐问题。
- 系统加固:根据智能体控制路线图,在开始高风险训练或评估前隔离并密封沙箱环境,并与合作伙伴共享安全最佳实践。
定价与发布计划
Gemini 4 Argon的初始定价为:每百万输入token 2美元,每百万输出token 10美元(缓存输入token享受95%折扣)。介绍期结束后,价格将调整为每百万输入token 4美元,每百万输出token 20美元。
模型将首先向付费API客户和Google AI Ultra订阅者开放,随后逐步扩展到开发者、企业和消费者。
总结
Gemini 4 Argon代表了谷歌在人工智能前沿领域的最新突破。其超长上下文、深度推理能力以及在编码、企业知识工作和网络安全方面的卓越表现,有望重新定义专业工作的效率与边界。谷歌通过分阶段发布和严格的安全措施,在释放强大能力的同时,致力于确保负责任的部署。
原标题:Gemini 4 Argon。 HN 原始发布时间:2026年10月1日星期四。当前记录为 1646 分、1128 条评论。