Muse Glimmer 发布:Meta 开源 30B 端侧智能体模型,量化后不足 20GB | 2026-08-11
Meta Superintelligence Labs 开源 30B 端侧智能体模型 Muse Glimmer(Apache 2.0 许可)。该模型从旗舰模型 Muse Spark 蒸馏而来,4-bit 量化后体积不足 20GB,单张消费级 GPU 即可本地运行。官方称其在 SWE-Bench、MCP-Atlas 等智能体基准上超过同尺寸的 Gemma4-31B 与 Qwen3.6-27B,配合 DFlash 推测解码在 RTX 5090 上生成速度提升 3.1 倍。