谷歌发布 Gemini 4“Argon”:Gemini 3 之后首款新一代旗舰
美东时间 9 月 30 日盘后,谷歌宣布推出全新旗舰模型 Gemini 4“Argon”——自 2025 年 11 月 Gemini 3 以来,谷歌的第一款新一代旗舰模型。按谷歌自测,它在 18 项企业基准中 13 项领先或并列第一,推广价只有 GPT-6 Astra 官方价的五分之一;但首批只对受信任的网络安全伙伴开放,没有公开发布时间表。

事件经过
谷歌在周三(9 月 30 日)盘后宣布推出 Gemini 4“Argon”,锚定全新的 Gemini 4 旗舰世代。路透社、Barron's、VentureBeat 在一小时内跟进报道。公司称这是“迄今性能最强的模型”,直接对标 OpenAI 的 GPT-6 Astra 和 Anthropic 的 Claude Opus 5.5。消息公布后,Alphabet 盘后股价上涨约 1.6%。
自 2025 年 11 月 Gemini 3 系列之后,谷歌再没有发布过新旗舰;承诺在 6 月交付的 Gemini 3.5 Pro 跳票;8 月 DeepMind 高层调整——Hassabis 卸任 CEO 转任主席,Jeff Dean 离职创业,Koray Kavukcuoglu 接任。根据 VentureBeat 转引的谷歌内部博文,Argon 先通过 Fairwind 计划向受信任的网络安全机构开放,同时接受美国政府的自愿预发布模型审查;全面开放将先从付费 API 客户和 Google AI Ultra 订阅者开始,但没有给出时间表。
基准数据全部来自谷歌自己的测试(共 18 项):Argon 12 项第一、1 项并列第一;GPT-6 Astra 3 项第一;Claude Opus 5.5 2 项第一。其中包括 DeepSWE v1.1 的 77.9%(Astra 74.1%、Opus 5.5 74.2%)、法律场景 Harvey 基准 19.6% 对 5.4% 和 3.8%、Gray Swan 间接提示注入攻击成功率 0.7% 对 Astra 的 8.5%。Astra 在 FrontierSWE v2 和 Terminal-Bench Science 上领先 10.5 个百分点,Opus 5.5 在 Terminal-bench 4.0 上领先 9 个点。
关键事实
- 发布:美东 9/30 盘后,谷歌宣布 Gemini 4“Argon”,新一代 Gemini 4 旗舰系列的第一款模型(据路透社、Barron's、VentureBeat)。
- 基准:谷歌自测 18 项企业基准:Argon 13 项领先或并列第一(12 项第一 + 1 项并列);Astra 3 项第一,Opus 5.5 2 项第一(据谷歌内部材料,经 VentureBeat 转引)。
- 强项:DeepSWE v1.1 77.9%、AutomationBench 51.3%、Harvey 法律基准 19.6%、Vals 财务基准 65.4%、Gray Swan 注入攻击成功率 0.7%;输出上限提升到 100 万 token(据谷歌披露)。
- 短板:Astra 在 FrontierSWE v2、Terminal-Bench Science 上领先 10.5 个百分点;Opus 5.5 在 Terminal-bench 4.0 上领先 9 个百分点(同上,均为谷歌自测)。
- 定价:推广期 $2/$10 每百万 token(缓存输入再打 95 折),是 Astra 官方价($10/$50)的五分之一、Opus 5.5($4/$20)的一半;推广期结束后上调为 $4/$20(据 VentureBeat)。
- 开放节奏:首批仅面向 Fairwind 计划的受信任网络安全机构,并接受美国政府自愿预发布审查;没有公开发布时间表(据路透社)。
背景
这是本周第三款 $2/$10 定价的旗舰级模型:9 月 28 日 Anthropic 发 Claude Sonnet 5.5($2/$10、快 30%),9 月 29 日 OpenAI 发 GPT-6.1 Sol($2/$10、号称接近 Astra 的智能),现在谷歌 Argon 的推广价也是 $2/$10。
在 Argon 之前,谷歌一年没有发布新旗舰,期间 3.5 Pro 跳票、出现人才流失。Argon 首批面向编码、法律、金融、网络安全防御等企业场景,而不是消费端聊天。
为什么重要
Argon 是谷歌自 2025 年 11 月 Gemini 3 以来首款新一代旗舰;本周 Anthropic、OpenAI 也各发布了一款 $2/$10 模型。
评论
今天
10月12日 星期一- 早报GSK 扩大与 Chai 合作:AI 设计通过湿实验室验证
共 9 条 · 10月11日
- 三问
- 预测
