Meta开源Muse Glimmer 30B本地Agent模型:单张消费级显卡即可运行
Meta开源Muse Glimmer 30B本地Agent模型:单张消费级显卡即可运行
Meta于8月10日开源300亿参数多模态Agent模型Muse Glimmer,Apache 2.0许可,4-bit量化后不到20GB,单张RTX 4090可流畅运行本地智能体任务。
核心信息
2026年8月10日,Meta Superintelligence Labs(MSL)正式发布并开源Muse Glimmer——一款300亿参数的稠密多模态Agent模型,采用Apache 2.0许可证开放权重。这是Meta自Llama 4以来首个开源大模型,由闭源旗舰Muse Spark蒸馏而来,定位为"可在个人电脑上持续运行的本地AI智能体"。
关键要点
- 消费级硬件友好:通过知识蒸馏+4-bit量化+DFlash推测解码三重优化,量化后模型体积不到20GB,单张24GB显存的RTX 4090即可运行
- 完整Agent能力:支持文本/图像输入、工具调用、多步推理、失败自动重试,128K上下文窗口,可执行文件整理、日程管理、本地编程等常驻任务
- 性能表现优异:在RTX 4090上实测,13万token上下文仅占19.34GB显存,输入预处理速度超3100 token/s,开启DFlash后输出速度可达75 token/s
- 开源生态持续推进:扎克伯格发文强调"超级智能应该普惠",并预告更强的旗舰模型Muse Spark 1.2权重也将在几周内开放
Muse Glimmer的发布标志着端侧AI Agent能力的重大突破,本地部署不仅能更好地保护用户隐私,也为开发者在消费级硬件上构建复杂的AI代理应用提供了可能。随着端侧模型能力持续提升,"每个人电脑上都有一个私人AI助手"的愿景正在加速成为现实。