Artificial Analysis 综合能力比较
38分
Intelligence Index
收录范围内第 16 名
测试配置:Preview · 源表未单列推理档位
材料读取 · · v4.3.2
各型号取来源页最高已测档位,保留回退设置;只按同一机构的分数排列。该指数主要评估英文文字任务,中文与图像能力另看实际评测。
原始评测与榜单 ↗Mistral AI · 发布 2026-10-06
从图纸演示与代码任务理解能力;API 公开预览、独立综合成绩和月底权重计划分别呈现。
模型原始说明 ↗38分
Intelligence Index
收录范围内第 16 名
测试配置:Preview · 源表未单列推理档位
材料读取 · · v4.3.2
各型号取来源页最高已测档位,保留回退设置;只按同一机构的分数排列。该指数主要评估英文文字任务,中文与图像能力另看实际评测。
原始评测与榜单 ↗官方图表与独立评测
Mistral 发布页给出 DeepSWE 1.1 为 61.7% 的成绩,图中取整为约 62,并列出 GLM、Kimi 等模型与各自的工具。
官方文档
官方回放示例
Mistral 10 月 6 日公布 Large 4 公开预览,定位为万亿参数级的通用图文模型。
新一代通用图文模型开放 API 预览;官方计划月底发布权重。
原始发布 ↗