Muse Glimmer

Muse Glimmer

Meta 2026年8月10日发布的30B开源大模型,Apache 2.0许可,4-bit量化后可在单张消费级显卡运行,专为本地智能体任务优化。

月访问量
0
累计浏览
2
用户评分
4.2
收录时间
2026-08

产品介绍

产品介绍

Muse Glimmer 是 Meta Superintelligence Labs 于 2026 年 8 月 10 日发布的开放权重大模型,参数规模约 30B(29.6B),采用 Apache 2.0 许可证开源,支持商用、修改和再分发。该模型由 Meta 闭源旗舰模型 Muse Spark 1.2 蒸馏而来,专为消费级硬件本地运行设计,4-bit 量化后模型体积小于 20GB,可在配备 24GB 或 32GB 显存的单张消费级显卡(如 NVIDIA RTX 5090、Apple M5 Max)上流畅运行。

核心功能

  • 30B 参数规模:由 Muse Spark 1.2 旗舰模型蒸馏而来,性能对标同级别模型
  • 本地部署友好:4-bit 量化后小于 20GB,单张消费级显卡即可运行
  • 智能体优化:专为日程管理、文件组织、本地编码、函数调用等智能体任务设计
  • DFlash 投机解码:RTX 5090 上解码速度提升 3.1 倍,M5 Max 提升 1.8 倍,输出质量与逐 token 生成一致
  • 多模态输入:支持交错文本和图像输入,包括截图、文档等
  • 100+ 语言支持:覆盖全球主要语种
  • 工具调用能力:训练具备工具调用失败诊断和重试机制,支持 OpenClaw 等智能体编排器
  • 可调推理强度:支持根据任务需求调整推理努力程度

性能表现

在同规模模型级别,Muse Glimmer 在以下基准测试中表现优于 Gemma4-31B 和 Qwen3.6-27B:

  • DeepSearch QA(检索能力)
  • MCP-Atlas(多步智能体规划)
  • τ-Bench(工具使用)
  • SWE-Bench(代码编写与调试)

本地部署

模型已在 Hugging Face 开放下载,发布即获得以下平台支持:

  • 推理框架:llama.cpp、MLX、ExecuTorch 优化集成即将推出
  • 桌面应用:Ollama、LM Studio、Unsloth 已支持
  • API 平台:Together AI、Fireworks AI、OpenRouter 上线即支持
  • 大规模推理:vLLM、SGLang 适配
  • 硬件优化:AMD、Arm、Dell、Intel、NVIDIA 合作优化中

开源许可

采用 Apache 2.0 许可证,允许:

  • 商业使用
  • 模型修改
  • 权重再分发
  • 无使用限制(对比部分竞品开源模型的附加限制)

典型使用场景

  • 本地离线 AI 助手(数据不出设备)
  • 端侧智能体应用(日程管理、文件操作)
  • 本地代码辅助编程
  • 隐私敏感场景的 AI 部署
  • 边缘设备 AI 推理