返回快讯列表
开源生态

Meta 开源 Muse Glimmer:300 亿参数,Apache 2.0 许可

Meta 超级智能实验室 8 月 10 日开源 Muse Glimmer,300 亿参数、支持图文交错输入、覆盖 100 多种语言,4 bit 量化后可塞进 24GB 显存跑本地智能体。

Meta 超级智能实验室 8 月 10 日放出 Muse Glimmer,一个 300 亿参数的模型,权重以 Apache 2.0 许可开放。它由更大的闭源模型 Muse Spark 蒸馏而来,训练数据偏向长上下文与智能体密集型场景,配了独立的感知编码器,能接受图文交错输入,让智能体直接读截图、图表和文档,覆盖 100 多种语言。

真正决定它能不能用的是内存账。官方给的数字:全精度权重需要 55GB 以上内存,做到约 4 bit 后语言模型部分压到 20GB 以内,整体瞄准 24GB 或 32GB 的显存区间,剩下的留给 KV cache、感知编码器和投机解码用的 drafter。配合量化后的 DFlash drafter,官方实测在 RTX 5090 上解码提速 3.1 倍,M5 Max 上 1.8 倍,M4 Max 上 1.5 倍。生态方面首日就接上了 Ollama、LM Studio、llama.cpp、MLX、vLLM、SGLang,以及 Together AI、Fireworks AI、OpenRouter 的托管服务。

许可证是这次最值得关注的变化。Llama 系列多年来用的是带 7 亿月活门槛的自定义协议,Apache 2.0 没有这类附加条件,商用、修改、再分发都不受限。如果你原本因为许可条款绕开 Meta 的权重,现在可以重新评估一次。要泼的冷水是:官方博客里的对比结果以图表形式给出,正文没有列具体分数,横向对标的是 Gemma4-31B 和 Qwen3.6-27B 这一档,独立第三方评测还没跟上。

更多快讯