Google DeepMind · 发布 2026-09-30

Gemini 4 Argon

长任务能力的新参照,当前先向受邀测试者开放;按具体任务拆开总分。

模型原始说明 ↗

在榜单中处于什么位置

Artificial Analysis 综合能力比较

53分

Intelligence Index

收录范围内第 3 名

high

各型号取来源页最高已测档位,保留回退设置;只按同一机构的分数排列。

材料读取 · · v4.3

原始评测与榜单 ↗

具体评测:看条件,也看结果

Google DeepMind 的模型迭代

  1. Gemini 3.7 Flash → 3.8 Flash

    在同一速度和价格定位上继续改进代码、多步推理与代理任务;Flash Cyber 是针对安全工作的另一变体。

    原始发布 ↗
  2. Gemini 4 Argon

    新一代模型公布,先向受邀测试者开放;较高评测分数不等于公众已经能用。

    原始发布 ↗