Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1
Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1
2024年7月24日法国Mistral AI发布Large 2,123B参数性能媲美GPT-4o与Llama 3.1 405B,支持80+编程语言,原生函数调用能力超越Claude 3.5 Sonnet,MMLU达84%。
2024 年 7 月 24 日,法国 AI 初创公司 Mistral AI 发布旗舰模型 Mistral Large 2,以 1230 亿参数的三分之一体量,在代码生成、数学推理和多语言能力上挑战 Meta 刚开源一天的 Llama 3.1 405B。
以小博大:三分之二参数的超越
Mistral Large 2 拥有 1230 亿参数,仅为 Llama 3.1 405B 的三分之一:
- MMLU 多任务语言理解准确率 84.0%,与 GPT-4、Llama 3.1 相当
- 代码生成能力与 GPT-4o、Claude 3 Opus、Llama 3.1 405B 相媲美
- 数学推理(MATH 基准零样本无思维链)排名第二,仅次于 GPT-4o
- 可在单个 NVIDIA H100 GPU 节点上运行
顶尖编程能力
Mistral AI 以代码模型著称,Large 2 进行了非常大比例的代码训练:
- 支持 80+ 编程语言(Python、Java、C、C++、JavaScript、Bash 等)
- HumanEval、MBPP 基准表现优异
- 原生函数调用(Function Calling)能力
- 支持并行和顺序函数调用
- 在函数调用测试中超越 GPT-4o 和 Claude 3.5 Sonnet
多语言支持:覆盖中文
相比 Llama 3.1 缺失中文的遗憾,Mistral Large 2 支持包括中文在内的十多种语言:
- 英语、法语、德语、西班牙语、意大利语、葡萄牙语
- 阿拉伯语、印地语、俄语、中文、日语、韩语
- 多语言 MMLU 平均性能超越 Llama 3.1 70B(高 6.3%)
128K 长上下文
- 128K token 上下文窗口
- 单次对话可接收约 300 页书的内容
- 增强的指令遵循和多轮对话处理
- 专注减少模型幻觉,不确定时诚实回应
开源与商用
- Mistral Research License:研究和非商业用途免费
- 商业部署需购买 Mistral Commercial License
- Hugging Face 开放权重下载
- 入驻 Google、Amazon、Azure、IBM 平台
公司背景
Mistral AI 是法国 AI 初创公司,2023 年 6 月成立:
- 核心团队来自 Google DeepMind
- 联创 Mensch 是 Chinchilla 论文作者,提出 Scaling Laws
- 2024 年 6 月 B 轮融资 6.4 亿美元,估值 60 亿美元
- 投资方包括 General Catalyst、英伟达、三星、IBM
- 被法国总统马克龙赞为「欧洲初创企业与美国科技巨头竞争的典范」
环保影响报告
2025 年 8 月,Mistral AI 发布首份 AI 模型生命周期分析报告:
- 训练过程二氧化碳排放 20.4 万吨
- 训练耗水 28.1 万吨
- 单次推理(400 Token)消耗 45ml 水,排放 1.14g 二氧化碳
- 研究发现:小型专长模型更具环保价值