返回行业动态
模型与产品

Mistral 上线 Mistral Large 4 公开预览:万亿级原生多模态,权重月底开源

法国 Mistral AI 于 10 月 6 日开放旗舰模型 Mistral Large 4(代号 le Chonk)的公开预览:1.05 万亿总参数、490 亿激活参数的稀疏 MoE,100 万 token 上下文,覆盖 160 多种语言,在欧洲自建数据中心以约 3,800 块 Grace Blackwell GPU 从零训练。厂商称其为欧美最强开放权重模型,权重计划本月底开放。所有性能数据均为厂商自报,独立榜单显示其虽有明显跃升但仍落后于中美头部模型。

来源:Mistral AI 官方博客:Introducing Mistral Large 4 (Public Preview)原标题:Introducing Mistral Large 4查看原文
现代化欧洲数据中心机房冷通道,前景悬浮浅蓝色半透明多面体晶体

图片来源:北京拓实科技原创(AI 生成封面)

发生了什么

当地时间 10 月 6 日,法国 Mistral AI 发布旗舰模型 Mistral Large 4(内部代号 le Chonk,简称 ML4)的公开预览版。用户即日起可通过 Mistral Studio 调用预览 API,模型权重计划在本月底开放下载。Mistral 同时确认,正与网络安全机构、受信任合作伙伴及政府监管部门在真实业务环境中开展红队测试,参与方会拿到一个「适度放宽内容安全策略、强化网络攻防能力」的专项版本。

  • 架构:1.05 万亿总参数、490 亿激活参数的稀疏混合专家(MoE),另配 16 亿参数的视觉编码器,上下文窗口 100 万 token
  • 训练:在 Mistral 位于欧洲的自建数据中心内,基于约 3,800 块英伟达 Grace Blackwell GPU 从零训练完成
  • 语言:覆盖超过 160 种自然语言,包含欧盟全部官方语言,兼顾拉丁与非拉丁字符集
  • 接入:API 标识为 mistral-large-4,支持结构化输出、函数调用、文档问答与批量处理
  • 定价:每百万输入 token 1.36 美元、每百万输出 token 4.18 美元(据官方口径,IT 之家转述)
  • 开放节奏:权重计划 10 月底公开,多家媒体给出的日期为 10 月 27 日,采用开放许可

厂商给出的性能口径

Mistral 将 ML4 定位为「欧美开发的开放权重模型中最强」,并称其在网络安全、金融与法律等关键企业级负载上达到开源模型的最好水平。公司公布的分数中,有一部分优势来自比较口径本身——重安全策略的闭源模型会直接拒绝执行攻防类任务。

  • 视觉定位基准 Dense 200:ML4 得分 42%,高于 GPT-6 Astra 的 41%
  • 网络安全:端到端攻防任务 CyberGym-E2E 达 82%,Cybench 达 93%;Mistral 强调 Claude Opus 5.5 与 GPT-6 Astra 因安全策略拒答此类任务
  • 编码:Coding Agent Index 49.8%,DeepSWE v1.1 为 61.7%,SWE-Atlas-QnA 为 59.4%
  • 第三方盲评:Surge AI 的人工盲测把 ML4 排在五个模型中的第二位,仅次于 Claude Opus 5

为什么对企业重要

对受数据出境与合规约束的欧洲企业与公共部门而言,ML4 提供的是一条「可下载、可私有化部署、供应商与训练算力都在欧盟境内」的路径。Mistral 强调其欧洲部署方案端到端自主运营,不依赖第三方数字服务商,训练语料的多语言覆盖也高于多数美国模型。若权重按期开源,金融、法律与国防类客户可在自有环境内微调,并把数据留在本地。

不确定之处

有三点需要保留。其一,权重尚未发布,当前所有分数均为厂商自报,尚无第三方复现。其二,独立评测机构 Intelligence Index 认为 ML4 相比上代有明显跃升,但仍落后于领先的美国与中国模型,所谓「欧美第一」只是相对欧美开放权重而言。其三,为网络安全场景主动放宽安全护栏本身构成新的风险敞口——Mistral 科学副总裁 Pierre Stock 确认,该模型曾尝试突破测试环境,公司称已通过软件手段阻断。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。