Mistral Large 4发布:1.05万亿参数,自称做出欧美最强开源模型
BiRun 讯,动察 Beating AI 快讯,法国 AI 公司 Mistral 发布新旗舰模型 Mistral Large 4,内部昵称「Le Chonk」。它采用 MoE 架构,总参数达到 1.05 万亿,但每次推理只激活 490 亿参数。模型原生支持图文输入,上下文最长 100 万 token。API 已开放预览,模型权重计划在 10 月 27 日公开。
Mistral 称,Large 4 是目前美国和欧洲开发的综合表现最强开放权重模型。官方给出的 DeepSWE v1.1 软件工程评测为 62%,其对比表中 GLM-5.3 为 61%、DeepSeek V4 Pro 为 57%、Qwen 3.8 Max 为 51%。金融评测 Finch 得到 67%,与 DeepSeek V4 Pro 持平;卫星图目标定位 DIOR-RSVG 得到 73%,高于 GPT-6 Astra 的 68%。
不过,这批成绩目前主要来自 Mistral 自测,并非统一口径。智谱发布 GLM-5.3 时,在同一个 DeepSWE v1.1 上公布的成绩是 66.9%,Kimi K3 则达到 67.5%,都高于 Large 4 的 62%。不同团队使用的测试配置和运行方式可能不同。
Large 4 从零训练,Mistral 用约 4000 块 Nvidia Grace Blackwell GPU,在欧洲自己的数据中心训练约两个月。Mistral 也把「欧洲自主」作为卖点,模型从训练、API 服务到未来自主部署,都可以留在欧洲基础设施上。
Mistral 称,Large 4 是目前美国和欧洲开发的综合表现最强开放权重模型。官方给出的 DeepSWE v1.1 软件工程评测为 62%,其对比表中 GLM-5.3 为 61%、DeepSeek V4 Pro 为 57%、Qwen 3.8 Max 为 51%。金融评测 Finch 得到 67%,与 DeepSeek V4 Pro 持平;卫星图目标定位 DIOR-RSVG 得到 73%,高于 GPT-6 Astra 的 68%。
不过,这批成绩目前主要来自 Mistral 自测,并非统一口径。智谱发布 GLM-5.3 时,在同一个 DeepSWE v1.1 上公布的成绩是 66.9%,Kimi K3 则达到 67.5%,都高于 Large 4 的 62%。不同团队使用的测试配置和运行方式可能不同。
Large 4 从零训练,Mistral 用约 4000 块 Nvidia Grace Blackwell GPU,在欧洲自己的数据中心训练约两个月。Mistral 也把「欧洲自主」作为卖点,模型从训练、API 服务到未来自主部署,都可以留在欧洲基础设施上。
评论
0/500
登录 后参与讨论
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯