OC
Meta 用 Muse Glimmer 重返开放模型:单显卡 Agent 开放了什么,保留了什么
科技 · 2026-08-12 · AI 模型 · 阅读 3

Meta 用 Muse Glimmer 重返开放模型:单显卡 Agent 开放了什么,保留了什么

作者:林岚|OC 开发者生态编辑

作者 林岚 林岚

Meta 发布 300 亿参数的 Muse Glimmer,以 Apache 2.0 许可证开放权重。模型面向本地 Agent,可调用工具、处理文件和截图、编写代码并执行多步骤任务;Meta 称量化版本可在一台 Mac 或配有单张消费级 GPU 的 PC 上运行。

一句话结论:Glimmer 把可下载、可微调的本地 Agent 能力交给开发者,但 Meta 留下了更强的 Muse Spark、训练数据与完整训练流程;这是实用的开放权重发布,不是把“个人超级智能”全部交给个人。

本地运行对 Agent 比普通聊天更有意义。一个整理文件、读取日历、起草消息和观察屏幕的助手需要接触大量个人上下文。如果每次工具调用都把数据传到云端,隐私和网络依赖都会成为产品瓶颈。Glimmer 可以离线工作,也允许组织在自己的机器上限定日志和权限。

“单显卡”仍有硬件条件。Meta 表示,300 亿参数全精度需要超过 55GB 内存;约 4-bit 量化后,语言模型缩到 20GB 以下,再加 KV cache、图像编码器和推测解码小模型,整体面向 24GB 或 32GB 内存空间。这属于高端消费硬件,不是普通 8GB 笔记本都能流畅运行。

Glimmer在本地隐私开放权重与高端显存需求之间的取舍

模型从更大的 Muse Spark 蒸馏而来,经过预训练、中期长上下文与 Agent 数据训练,以及监督微调、在线蒸馏和强化学习。它支持 100 多种语言和图文输入,并针对工具调用、失败恢复、代码任务和长流程进行训练。Meta 还计划支持 llama.cpp、MLX、ExecuTorch、vLLM 和 SGLang 等生态。

但开放的边界要说清。开发者可以下载和修改 Glimmer 权重,Apache 2.0 也比定制限制许可证宽松;更强的教师模型 Muse Spark 仍是闭源,训练语料和完整数据治理也未随权重发布。开放权重让部署可控,不自动让模型来源完全可审计。

Meta 选择开放较小模型、保留更强模型,也反映其新策略:用开放生态扩大部署和开发者影响力,把最高能力与云服务继续掌握在公司手中。对个人 Agent 而言,真正的自主还取决于操作系统权限、工具协议和模型更新是否由用户控制。

关键事实

  • Muse Glimmer 有 300 亿参数,以 Apache 2.0 开放权重
  • 量化模型小于 20GB,完整运行预算面向 24GB 或 32GB 内存
  • 支持文字、图像、工具调用、代码和多步骤 Agent 工作流
  • 更强的教师模型 Muse Spark 仍由 Meta 封闭控制

OC 判断

Glimmer 是 Meta 回到开放权重竞争的一次实质发布,尤其适合需要本地数据访问的 Agent。但“在你的设备上”不能替代权限设计:模型离线运行后,文件删除、消息发送和账户操作反而更需要可审计工具层。

为什么重要

  • 对开发者:可在本地微调和部署 Agent,但硬件门槛仍高于普通消费设备。
  • 对企业:数据不出机可以降低部分隐私风险,同时增加本地更新与安全运维责任。
  • 对开放生态:宽松许可证扩大可用性,但教师模型和训练数据仍构成能力上限。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论

继续看看 OC 用户围绕这个话题说了什么、做了什么。

相关碎碎念

更多

最近越来越多思考,我们跟agent的关系,比如我最近用blender mcp很多,基本上我算是会用blender的,但是老记不住很多热键,以前我可以做很复杂的模型,但是要是不是的去查blender的操作热键。现在我完全不参与模型的建模,只让codex帮我生成。 但是我还是在查blender的热键,我现在需要的是numpad .这样聚焦到一个对象的方法,我需要的是numpad /这样的方法来把除了选中的对象,其他都隐藏的热键。 换言之,我现在需要高效的人工视觉复检blender mcp的成果,这是我对自己目前blender能力的需求了。

tinyfool 2 0

帕格尼物语的任务全部打穿,然后开始玩社区创作的地图,这种游戏在建设的时候特别过瘾,建立起稳定的经济模型后也很过瘾,稳定下来观察小人的行为也很过瘾,然后如果没有外部矛盾,比如敌人侵略或者必须找到某种材料,等等的问题,就开始索然无味了。 人生其实也像这样的游戏,我曾经构建过几次自己的稳定架构,然后就索然无味,然后又因为抑郁,崩塌了,我在人生这个游戏最近感觉有有点动力不足,就是因为每次架构彻底崩塌才来重建,十分疲惫

tinyfool 0 1

从第一份程序员职业至今,已经过了 20 年,现在已经不再亲自写代码了,年初看到 Codex/Claude 火爆,又起心动念开始堆代码,只不过现如果自己亲手写的代码,跟 AI 写的代码放在一起,我开始有种耻感涌上来。是到了把关注点挪到像我这种老登程序员的生活上的时候了。

lgn21st 1 1

相关帖子

更多

你们的Codex额度提前耗完了没?戒断反应如何?

<p>我在第三天就消耗了只剩1%,忍了一天,然后今天干脆用这最后的1%,开着5.6 Sol 极高 强推我一个提示词笔记本应用的功能落地。最终用时3小时,居然还是跑完了。但是现在还是出现一些戒断反应,感觉啥也做不了,就无精打采的,困。</p> <p>我做了一个Prompt Notebook,专门用来收藏或者记录自己手搓的生图提示词。带Chrome一键收藏插件。支持AI优化提示词。支持提示词中提取常用字段作为提示词百科词汇。也自带生图功能用来测提示词。但是要搭配Cloudflare R2+Worker的图床。</p> <p>今天主要是做一个AI模特的资产库。将常用的AI模特固定下来,进行身份设定,以及模特的一些角色定妆图。之后生图可以直接调用AI模特自动作为垫图。</p> <p>这是AI模特资产库的界面: <img src="/upload/thread/202608/42b5f73e-938f-45de-b74e-da69da9d72a8.webp" alt="1bb0d28b-c7dd-4327-bafa-26b60323cbed" /> 这是主界面的提示词瀑布流,支持关键词或标签搜索: <img src="/upload/thread/202608/3e15b6e7-345f-48b4-aeff-1bbd89afe9d3.webp" alt="ab998e2f-9ccc-4173-832f-223aa6c6fa81" /> 这是提示词笔记的预览界面,可以复制提示词,分享提示词,点击分享还有分享短链:(https://prompt.jintao.co.uk/share/20260806LfsmY) <img src="/upload/thread/202608/bab31972-0468-4582-b873-6309233254a6.webp" alt="20260806-201213" /> 可惜现在没额度了,我又不想换模型折腾。现在还有些界面细节和小功能需要落地完善,可能还要虫子要抓。弄好了,打算放GitHub开源。</p> <p>有朋友想试试的么?</p>

shynloc 2 4

一个体会,Codex 这种现代 Agent,每天一个变,几天不用就有新惊喜

<p>当然我说的也包括 Claude Code,新功能日新月异,还有就是 AI 能力提升以后,可以做的东西日新月异。还有各种工作流方法日新月异。</p> <p>更好玩的是,我最近经历过很多次,你跟人介绍现在 Codex 可以做到什么样子,他们都觉得很厉害。但是你现场一演示,他们的震撼就更加完全不同了。所以,这种东西,需要大量的 Workshop 去沟通交流,光看文字很难讲清楚,直播、视频也越来越重要了。</p>

tinyfool 1 89

重返OurCoders

<p>从2014年以来好久没逛过这个谈论了,不知道这个谈论的运营现在怎么样,开发人员是不是原来的人,前端UI做得不太好</p>

梁建溢 5 36