Meta开源多模态模型Muse Glimmer现已上线Ollama
Muse Glimmer是Meta最新的开源模型,也是Meta超人工智能实验室(Meta Superintelligence Labs)发布的首款模型,现已可在Ollama上使用。这是一款30B参数的多模态模型,专为本地运行的Agent任务而设计,支持128K+上下文长度,采用Apache 2.0许可证发布。
通过Ollama,你可以使用Muse Glimmer驱动Claude Code、Codex、Pi等编程Agent应用,以及OpenClaw、Hermes等长时间运行的个人助理。
在Apple Silicon上,可通过Ollama的MLX引擎运行,该引擎新增了对DFlash和图像输入的支持,带来业界领先的性能表现。
运行Muse Glimmer,下载最新版本的Ollama后执行:
ollama run muse-glimmer
在Apple Silicon上若希望使用MLX引擎获得最佳性能,请使用:
ollama run muse-glimmer:30b-mlx
在本地驱动编程Agent
与Claude Code配合使用Muse Glimmer,下载Ollama后执行:
ollama launch claude --model muse-glimmer
对于更轻量的编程Agent,可以尝试Pi:
ollama launch pi --model muse-glimmer
对于OpenClaw和Hermes等个人助理框架,使用:
ollama launch openclaw --model muse-glimmer
ollama launch hermes --model muse-glimmer
ollama launch同样支持Codex、OpenCode、GitHub Copilot等工具。查看所有集成。
Muse Glimmer还支持可控推理强度:low、medium、high和xhigh。复杂编程和Agent任务建议使用high或xhigh,在速度优先的场景则选择较低的强度。
Apple Silicon上利用DFlash和图像输入实现业界领先的性能
Ollama的MLX引擎现已支持DFlash,在之前多Token预测(MTP)支持的基础上进一步优化。借助DFlash,Muse Glimmer在Apple Silicon上的运行速度提升了1.5×–1.8×。
通过 Ollama 的 MLX 引擎运行 Muse Glimmer,请使用 muse-glimmer:30b-mlx 模型。
Muse Glimmer 配备了专用的 1.8B 参数视觉编码器,原生支持图像理解。MLX 引擎新增了图像输入支持,编码代理(coding agents)可对其进行低延迟、连续的工具调用,适用于需要图像的任务,例如:
- 根据草图或原型构建网站或应用
- 基于截图的计算机操作应用
- 读取文档、收据和图表