概念解读 · 2026 年 9 月 8 日

模型能下载,数据就留在本地吗?

从 Mistral 的新融资消息,分清开放权重、运行位置与数据路线;用一份文档的三种处理方式,看懂该问什么。

01从今天的消息说起

“开放”与“自主”,具体控制的是什么?

9 月 8 日,Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元。公告把自主性分成数据、模型、算力和运行系统四个方面。这是公司对自己方向的陈述;读者仍需查看具体产品怎样工作。

假设你想让 AI 总结一份内部文档。先别把“使用开放模型”当成数据去向的答案:模型由谁提供、在谁的机器上运行、文档还交给了哪些工具,是三个不同的问题。

02先分清模型与服务

拿到权重,拿到的是模型学到的参数

权重可以理解为训练后留下的一组数字参数;它们要与模型结构和运行程序一起,才能处理输入。“开放权重”通常说明这些参数可取得,但具体可怎样使用,还要看该模型提供的条件。

“开源 AI”还有不同机构提出的明确标准。例如,开放源代码促进会(OSI)的 1.0 定义同时涉及使用、研究、修改和分享的自由,以及数据说明、代码和参数。仅看见下载按钮,不能据此判定一个系统满足这套定义。

03沿一份文档看路线

同样的模型,可以有不同的数据路线

下面是本站编写的三种示意情形,不是某款产品的实测。每条箭头表示一份输入被交给下一步处理;是否跨出你管理的环境,取决于实际部署与工具配置。自己部署也可以使用租来的云服务器,不一定是放在个人电脑上。

Mistral 的 Vibe Code 离线使用文档也提醒:本地模型配置之外,遥测、自动更新和访问外部服务的工具需要分别处理。由此可以看出,模型位置与整个应用的数据路线要分别核对。

要追的是文档的路线,而不只是模型的名字
  1. 情形 A · 全部在你管理的环境文档 → 本地应用 → 本地模型

    这个简化情形没有外部处理步骤。仍要检查应用是否另有联网功能、日志或同步。

  2. 情形 B · 使用托管服务文档 → 服务商的应用 → 服务商运行的模型

    即使模型权重可下载,这次请求仍由服务商处理。数据保留与使用方式要看该服务的说明。

  3. 情形 C · 本地模型加外部工具文档 → 外部文字识别 → 本地模型

    模型在本地,但前一步已经把文档交给其他服务。只核对模型地址会漏掉这段路线。

04一个真实文档中的细节

代码在本地,也不表示所有数据都留在本地

Mistral Workflows 的官方说明提供了一个具体例子:默认混合模式中,用户代码在自己的环境运行,任务协调、状态与历史由平台管理,流程输入和输出会经过平台。文档也说明了加密,以及把较大输入输出放到自己管理的文件存储服务(对象存储)等控制办法。

加密专页把流程交换的输入、输出等数据称为“载荷”。它区分了默认的明文模式,以及额外配置后的加密模式;后者还可选择加密全部内容或指定字段。这是应用数据处理的区别,不能据此说网络传输没有加密。输入经过平台,也不能直接推断它被用于训练或已经泄露。

因此,看到“代码运行在自己的环境”,下一步应追问哪些数据会经过平台、哪些保护已经启用。这里说明的是这份文档中的混合模式,不能据此推断 Mistral 的所有产品都采用同一条数据路线。

05把概念用到具体工作

拿一份示例文件,问清三件事

可以先用不含私人或内部信息的示例文件,要求工具提供者说清下面三件事。这是本站建议的理解方法,不是某个产品已通过检查的结论。

  • 处理在哪里发生?分别确认应用、模型和文字识别、搜索等外部工具。
  • 哪些内容会被保留?把原文件、提示词、输出、操作日志与同步副本分开问,并查看实际服务说明。
  • 如果要换工具,能带走什么?用示例确认原文件、成果和必要设置如何导出;能拿到模型,不等于已经能搬走整个工作流程。