谷歌承诺在6月推出Gemini 3.5 Pro,但整个夏天都在发布较小的Flash模型。现在,谷歌准备好推出Gemini 4 Argon,声称在编码、知识工作和网络安全方面具有行业领先的性能,但你还不能使用它。公司内部的工程师已经在广泛使用该模型。
Argon使用“全舰队遥测数据”在数据中心节省了300 TiB的内存。代理已将C/C++代码库迁移到Rust,包括核心re2和libgav1库中的数千行代码,以及Fuchsia OS Zircon内核中的80万行以上代码。
谷歌用基准测试支持其说法。在软件工程Deep SWE v1.1基准测试中,Gemini 4 Argon达到77.9%,高于GPT-6 Astra、Fable 5.1和Opus 5.5。它还在经济分析Vals Index测试中取得行业领先的分数。
该模型处于有限测试阶段,但已公布API定价:每百万输入tokens 2美元,每百万输出tokens 10美元,缓存输入tokens享受95%折扣。Gemini 4 Argon支持100万tokens的输出限制,高于之前模型的64,000 tokens。
关键实体:公司:Google
来源: Ars Technica · 由HeadlinesBriefing整理摘要