产品简介
Meta Muse Glimmer是Meta超级智能实验室于2026年8月10日开源的30B稠密多模态模型,采用Apache 2.0协议,由旗舰模型Muse Spark 1.2蒸馏而来,是Meta迄今许可最宽松的开放权重模型之一。该模型面向本地智能体场景,单张消费级显卡即可运行,支持图文视频输入与工具调用,旨在推动高级AI的分布式发展。其架构融合混合滑动窗口注意力与全量注意力交替、GQA(KV缓存降16倍)、2D RoPE及Pixel Shuffle压缩视觉Token,并配套DFlash投机解码草稿模型加速生成。模型在通用智能体与代码场景表现领先,已上线OpenRouter,开发者实测可在单张RTX 4090上跑长上下文。
核心功能
- 多模态输入与工具调用:支持图像、文本、视频输入,视频最高96帧采样,并具备工具调用与目标检测能力,适配复杂智能体任务。
- 高效架构设计:采用混合滑动窗口注意力与全量注意力交替,结合GQA将KV缓存降低16倍,2D RoPE增强位置编码,Pixel Shuffle压缩视觉Token,提升长上下文处理效率。
- 轻量部署友好:4-bit量化版小于20GB,单张消费级显卡或MacBook即可运行,兼容NVIDIA、AMD、Intel硬件,GGUF量化包开箱即用。
- 加速推理配套:配套DFlash投机解码草稿模型,显著加速生成,尤其在代码与结构化生成场景收益最大。
- 生态适配广泛:transformers、llama.cpp、vLLM、HF Inference Endpoints首日适配,支持LoRA与全参微调,微调最低单张80GB H100。
- 开源许可宽松:采用Apache 2.0协议,允许自由使用、修改与分发,是Meta迄今许可最宽松的开放权重模型之一。
适合谁用
以下类型的用户会特别受益于 Meta Muse Glimmer:
- 本地智能体开发:在单张消费级显卡上运行,构建自主决策与工具调用智能体。
- 多模态内容理解:处理图文视频混合输入,用于视频分析、图像识别与目标检测。
- 代码生成与结构化输出:利用DFlash加速,提升代码补全、结构化数据生成效率。
- 长上下文任务:在RTX 4090上运行长上下文场景,如文档摘要、多轮对话。
- 研究微调:基于TRL进行LoRA或全参微调,适配特定领域需求。
优点亮点
- 开源许可宽松,Apache 2.0协议利于商业与学术使用。
- 单卡可运行,部署门槛低,适合个人开发者与中小企业。
- 多模态能力全面,支持视频输入与工具调用,功能丰富。
- 推理加速配套完善,代码与结构化生成性能突出。
- 生态适配广泛,主流框架首日支持,集成便捷。
- 基准表现领先,MCP Atlas 75.5、SWE-Bench Pro 51.2,通用智能体与代码场景优势明显。
价格与方案
模型权重免费开源,具体使用成本以官网为准。
总结与建议
Meta Muse Glimmer是一款开源多模态模型,以Apache 2.0协议发布,单卡可运行,支持图文视频输入与工具调用,在通用智能体与代码场景表现领先,生态适配广泛,适合本地部署与微调。