法国 AI 实验室 Mistral 于 10 月 6 日发布了其迄今最大、最强的模型 Mistral Large 4(内部代号「Le Chonk」,意为「大胖猫」),向美国闭源前沿模型和中国开源权重模型发起正面挑战。
要点一:万亿参数的混合专家架构。 模型总参数 1 万亿、每次推理仅激活 49B,原生多模态,支持 160 多种语言,上下文窗口长达 100 万 token,API 公开预览已上线。
要点二:欧洲本土高效训练。 模型在 Mistral 欧洲自有数据中心、用约 3800 块英伟达 Grace Blackwell GPU 从零训练,据称训练算力只有中国竞品的二分之一到三分之一。
要点三:网络安全能力突出。 在 CyberGym-E2E 基准上拿到 82%、Cybench 93%,而 Claude、GPT 等闭源模型因拒绝作答在该项接近零分。CEO Artur Mensch 表示,「欧洲无法竞争」的说法并不成立。完整开源权重预计 10 月底放出。
原文链接:点击查看原文,正文为摘要整理,仅供参考。




