月访问量
0
累计浏览
2
用户评分
4.2
收录时间
2026-08
产品介绍
产品介绍
Muse Glimmer 是 Meta Superintelligence Labs 于 2026 年 8 月 10 日发布的开放权重大模型,参数规模约 30B(29.6B),采用 Apache 2.0 许可证开源,支持商用、修改和再分发。该模型由 Meta 闭源旗舰模型 Muse Spark 1.2 蒸馏而来,专为消费级硬件本地运行设计,4-bit 量化后模型体积小于 20GB,可在配备 24GB 或 32GB 显存的单张消费级显卡(如 NVIDIA RTX 5090、Apple M5 Max)上流畅运行。
核心功能
- 30B 参数规模:由 Muse Spark 1.2 旗舰模型蒸馏而来,性能对标同级别模型
- 本地部署友好:4-bit 量化后小于 20GB,单张消费级显卡即可运行
- 智能体优化:专为日程管理、文件组织、本地编码、函数调用等智能体任务设计
- DFlash 投机解码:RTX 5090 上解码速度提升 3.1 倍,M5 Max 提升 1.8 倍,输出质量与逐 token 生成一致
- 多模态输入:支持交错文本和图像输入,包括截图、文档等
- 100+ 语言支持:覆盖全球主要语种
- 工具调用能力:训练具备工具调用失败诊断和重试机制,支持 OpenClaw 等智能体编排器
- 可调推理强度:支持根据任务需求调整推理努力程度
性能表现
在同规模模型级别,Muse Glimmer 在以下基准测试中表现优于 Gemma4-31B 和 Qwen3.6-27B:
- DeepSearch QA(检索能力)
- MCP-Atlas(多步智能体规划)
- τ-Bench(工具使用)
- SWE-Bench(代码编写与调试)
本地部署
模型已在 Hugging Face 开放下载,发布即获得以下平台支持:
- 推理框架:llama.cpp、MLX、ExecuTorch 优化集成即将推出
- 桌面应用:Ollama、LM Studio、Unsloth 已支持
- API 平台:Together AI、Fireworks AI、OpenRouter 上线即支持
- 大规模推理:vLLM、SGLang 适配
- 硬件优化:AMD、Arm、Dell、Intel、NVIDIA 合作优化中
开源许可
采用 Apache 2.0 许可证,允许:
- 商业使用
- 模型修改
- 权重再分发
- 无使用限制(对比部分竞品开源模型的附加限制)
典型使用场景
- 本地离线 AI 助手(数据不出设备)
- 端侧智能体应用(日程管理、文件操作)
- 本地代码辅助编程
- 隐私敏感场景的 AI 部署
- 边缘设备 AI 推理