模型更新 · 能力与使用入口

Mistral Large 4 来了:先看图纸、代码与实际入口

新一代图文模型开放 API 预览。把官方的图纸演示、代码任务成绩与独立综合分数接起来,看看它在已有 GLM、Kimi 和 Beam 选择之外带来了什么。

当前是 Mistral Studio 的 API 公开预览;官方计划在 10 月底发布权重。

Mistral 官方回放中,图纸的零件表与剖视图编号被橙色标记连起来。
官方图纸演示的回放画面。编号、零件表与局部图像共同构成回答依据;不是本站生成或验证的工程结论。 · 打开大图
本文目录目录3

EN

把问题指回图中的位置

Mistral 10 月 6 日公布 Large 4 公开预览,定位为万亿参数级的通用图文模型。发布资料强调代码、工具任务和视觉理解,并给出图纸、图表与文档演示。

图纸例子从“两处零件是否接触”这样的具体问题开始,先查零件表,再放大剖视图、对照编号。值得看的不是回复写得多长,而是它怎样把一句问题接回可以检查的位置。这是官方组织的回放示例,后续仍可沿同一任务观察独立使用结果。

来源与延伸阅读

EN

具体任务与综合分数,分别提供参照

Mistral 发布页给出 DeepSWE 1.1 为 61.7% 的成绩,图中取整为约 62,并列出 GLM、Kimi 等模型与各自的工具。它回答的是特定代码任务的表现;图中的工具条件与自报项目,需要连同分数一起读。

另看 Artificial Analysis 当前综合榜,Mistral Large 4 Preview 为 38。下表保留同一来源中几种已有选择的实际档位:它帮助建立大致位置,不能把不同档位当成相同计算预算,也不能将综合分数直接换算成图纸或中文任务的成功率。

Artificial Analysis v4.3.2 · 10 月 7 日读取,整数显示值。
模型与设置综合指数
GLM-5.3 · max45
Kimi K3 · max44
DeepSeek V4.1 Flash · max39
Mistral Large 4 Preview · 源表未标推理档位38
Mistral 发布的 DeepSWE 1.1 图表:Mistral Large 4 Preview 的柱顶约为 62,各模型附有工具条件。
Mistral 原图。纵轴从 40 起,读差距请看柱顶数字;图注说明包含评测工具公开前的私测结果,Beam 一项为自报,各模型所用工具也不同。 · 打开大图
来源与延伸阅读

EN

现在从 API 进入,权重发布继续跟进

当前模型卡提供 mistral-large-4 入口与 1M 上下文,列出图文对话、文档问答、工具调用和结构化输出等能力。使用的是托管服务;月底发布权重仍是官方计划,不能把今天的预览理解成已经可以下载同版模型。

这可以接回我们已有的两条线:Beam 同样需要分清预览接口与权重进度;GLM、Kimi 的 Bedrock 示例则说明,模型还要经过服务与工具接入,才进入实际工作。下一步值得继续收集的是同一份材料、同一套工具下的公开结果与返工。

来源与延伸阅读