Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1

正飞GEO 2026年07月31日 03:38 2 阅读 来源:Mistral AI
Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1 Mistral Large 2发布:1230亿参数以三分之一体量卷爆Llama 3.1
2024年7月24日法国Mistral AI发布Large 2,123B参数性能媲美GPT-4o与Llama 3.1 405B,支持80+编程语言,原生函数调用能力超越Claude 3.5 Sonnet,MMLU达84%。

2024 年 7 月 24 日,法国 AI 初创公司 Mistral AI 发布旗舰模型 Mistral Large 2,以 1230 亿参数的三分之一体量,在代码生成、数学推理和多语言能力上挑战 Meta 刚开源一天的 Llama 3.1 405B。

以小博大:三分之二参数的超越

Mistral Large 2 拥有 1230 亿参数,仅为 Llama 3.1 405B 的三分之一:

  • MMLU 多任务语言理解准确率 84.0%,与 GPT-4、Llama 3.1 相当
  • 代码生成能力与 GPT-4o、Claude 3 Opus、Llama 3.1 405B 相媲美
  • 数学推理(MATH 基准零样本无思维链)排名第二,仅次于 GPT-4o
  • 可在单个 NVIDIA H100 GPU 节点上运行

顶尖编程能力

Mistral AI 以代码模型著称,Large 2 进行了非常大比例的代码训练:

  • 支持 80+ 编程语言(Python、Java、C、C++、JavaScript、Bash 等)
  • HumanEval、MBPP 基准表现优异
  • 原生函数调用(Function Calling)能力
  • 支持并行和顺序函数调用
  • 在函数调用测试中超越 GPT-4o 和 Claude 3.5 Sonnet

多语言支持:覆盖中文

相比 Llama 3.1 缺失中文的遗憾,Mistral Large 2 支持包括中文在内的十多种语言:

  • 英语、法语、德语、西班牙语、意大利语、葡萄牙语
  • 阿拉伯语、印地语、俄语、中文、日语、韩语
  • 多语言 MMLU 平均性能超越 Llama 3.1 70B(高 6.3%)

128K 长上下文

  • 128K token 上下文窗口
  • 单次对话可接收约 300 页书的内容
  • 增强的指令遵循和多轮对话处理
  • 专注减少模型幻觉,不确定时诚实回应

开源与商用

  • Mistral Research License:研究和非商业用途免费
  • 商业部署需购买 Mistral Commercial License
  • Hugging Face 开放权重下载
  • 入驻 Google、Amazon、Azure、IBM 平台

公司背景

Mistral AI 是法国 AI 初创公司,2023 年 6 月成立:

  • 核心团队来自 Google DeepMind
  • 联创 Mensch 是 Chinchilla 论文作者,提出 Scaling Laws
  • 2024 年 6 月 B 轮融资 6.4 亿美元,估值 60 亿美元
  • 投资方包括 General Catalyst、英伟达、三星、IBM
  • 被法国总统马克龙赞为「欧洲初创企业与美国科技巨头竞争的典范」

环保影响报告

2025 年 8 月,Mistral AI 发布首份 AI 模型生命周期分析报告:

  • 训练过程二氧化碳排放 20.4 万吨
  • 训练耗水 28.1 万吨
  • 单次推理(400 Token)消耗 45ml 水,排放 1.14g 二氧化碳
  • 研究发现:小型专长模型更具环保价值
分享到: