小扎万字檄文炮轰硅谷,Meta重磅开源30B小钢炮!一台MacBook就能跑
就在刚刚,Meta发力了!
首先,Meta超级智能实验室正式发布全新30B大模型 —— Muse Glimmer,而且重磅开源。

这个智能体模型,专为本地设备量身定制。它性能强大,却被塞进不到20GB的内存里,只要一块消费级 GPU(比如 RTX 5090)或者一台 M4/M5 Max 的 MacBook 就能流畅运行!
而且,Meta这次采用的是最良心的 Apache 2.0 协议,允许免费商用,随便造。
另一方面,Meta CEO 小扎亲自下场,发表了一篇万字重磅宣言——《未来属于每个人》。


这个长篇檄文中,他没有点名,却处处都在暗讽OpenAI 和 Anthropic。
他开炮说:有些人天天炒作AI末日论,试图把超级智能集中在少数几家公司和少数精英手里,这才是人类面临的最大危险!
Muse Glimmer:塞进你背包里的「超级智能」
虽然如今的开源AI很多,但真正能干活的模型,普通人的电脑跑不动;能跑得动的模型,又仿佛智障。
Muse Glimmer 的诞生,就是为了打破这个僵局。
Meta的野心是:让这个30B 模型能「完全离线、本地运行」!
这意味着,你可以在没有网的飞机、高铁上随时调用这个超级大脑,而且还能保障隐私安全,本地文件、私人代码不必上传远端。

30B模型,怎样塞进个人电脑里?Meta有以下几大黑魔法。
极限压缩:20GB 以内的完美瘦身
按照常规精度,30B模型无论怎样都得吃掉 55GB 以上的显存,这远远超出了消费级显卡的极限。
为此,Meta 团队使用了4-bit 量化压缩技术,硬生生将模型权重压缩到 20GB 以下。

更惊人的是,这种极致的压缩「对智能体任务的性能表现几乎没有造成任何衰减」。
从此,在 24GB 显存(如 RTX 3090/4090)或 32GB 内存(如 Mac 统一内存)的设备上,我们不仅能跑这个模型,还能留出足够空间,给它的「视觉感知编码器」和上下文缓存。
DFlash 投机解码:让生成速度起飞
本地运行大模型最怕什么?就是慢。
模型一个字一个字地挤牙膏,极其破坏工作流。
为了解决这个问题,Muse Glimmer 自带了一个基于 DFlash 技术的轻量级「草稿模型」。
这个小模型会一次性「猜」出一大段 Token,然后交给主模型进行并行验证。对了就保留,错了就修改。

这种「投机解码」技术,在不牺牲任何输出质量的前提下,让 Muse Glimmer 在 RTX 5090 上的生成速度直接飙升了 3.1 倍!
在 MacBook M4-Max 和 M5-Max 上,它同样快得飞起,撑得起流畅的实时对话和复杂的代码生成。

真正的「智能体」
而且,Muse Glimmer 的定位不仅仅是一个LLM,它是专为智能体工作流优化的。
它是由 Meta 最顶级的闭源大模型 Muse Spark 经过「逻辑蒸馏」训练,继承了这个顶级模型的灵魂。
它具备五大核心超能力。
端到端任务完成:在 DeepSearch QA、SWE-Bench 等极难的测试中表现优异,能从头到尾帮你写代码、DeBug、查资料。
可靠的工具调用:能精准识别什么时候该调用计算器,什么时候该搜索本地文件,什么时候该运行代码。
失败恢复能力:这是智能体最关键的能力。当代码报错或工具调用失败时,它不会直接宕机罢工,而是会像人类程序员一样,自动诊断错误、修改参数并重新尝试!
长程多步推理:能够制定长期的连贯计划,不会做着做着就「失忆」。
多模态理解:能够直接看懂你的屏幕截图、图表和文档,实现图文穿插推理。
在各项基准测试中,Muse Glimmer 在同体量模型中与 Gemma4-31B 和 Qwen3.6-27B 不相上下,并且在「智能体操作」上表现惊人。

最重要的是,它采用了 Apache 2.0 协议!
这意味着无论是个人开发者还是企业,都可以免费商用。
目前权重已经上线 Hugging Face,并且很快就会全面接入 Ollama、LM Studio 等主流本地运行工具。

https://huggingface.co/meta-models/Muse-Glimmer-30B
前Meta超能实验室评估负责人Zengyi Qin分析称,Muse Spark将对全球开源模型形成降维打击。

原因在于,Meta今年的基础设施预算高达1450亿美元,因此Meta拥有更多算力;他们还有合规的优势。
最关键的,Meta为什么要开源?因为他们根本不需要靠卖API赚钱!
30B免费模型,Apache 2.0协议,将对让开源实验室的商业逻辑形成巨大冲击。
小扎万字檄文,
彻底撕下硅谷「AI安全」的假面
同时,小扎发布了一篇万字长文,可以说是Meta向整个闭源阵营下的战书!

这篇文章,让所有人都惊了:很少看到攻击性这么强的小扎。
文章的核心思想就是:超级智能必须属于每个人,把超级智能集中在少数人手里,才是人类最大的危险!
猛烈抨击「AI 末日论」与权力集中
我们都知道,硅谷有那么两家公司,特别喜欢玩这套叙事:AI太危险了,随时会毁灭人类,所以必须锁在几个精英公司手里。
小扎对此发出猛烈抨击:
认为 AI 如此危险,以至于唯一的安全途径就是权力的极端集中,这种观念本身就存在着固有的问题。纵观历史,指望一个绝对的权力如果足够开明就能仁慈地养活人类,从来没有带来过安全或积极的结果。
他举例说,如果世上只有一个人拥有「超级智能律师」,那他在法庭上将拥有绝对优势,让社会倒退。但如果每个人都有一个这样的律师,世界反而会更公平。
同理,少数人掌握超级黑客AI是灾难,但如果每个人都有超级AI在做防御,整个世界的数字基础设施将坚不可摧。
「真正的安全,来源于权力的制衡,而不是权力的垄断。」

颠覆性的「AI 对齐」观:AI 应该听谁的?
关于 AI 对齐,扎克伯格爆出金句:
人类不是单一的文化……不存在一种技术解决方案,可以同时满足所有人相互冲突的利益。因此,没有任何一个单一的超级智能可以对所有人都是仁慈的。
他严厉批评了竞品的做法:某家领先的模型,仅仅因为其公司内部认为「标准化考试是不道德的」,就拒绝帮用户起草一封写给学校的信!
这根本不是对齐,这叫「把公司的教条强加给用户」!
Meta 提出:AI 必须与用户个人的目标和价值观对齐,而不是与 Meta 公司的价值观对齐。
为此,小扎承诺,Meta 将为个人 Agent 提供「完全私密模式」,如同 WhatsApp 的端到端加密一样。
开源生态的生死存亡,直指美国监管政策
在文章后半段,小扎对美国目前的AI监管政策表达强烈不满。
他说,这种过度严苛的限制,是在「给竞争对手送大礼」。
而且,小扎居然选择公开站台蒸馏!

他指出,从其他模型中学习,是开源生态系统运作的重要原则。「任何 AI 模型都源于人类知识……你应该可以从任何你能观察到的事物中学习,这就是世界运转的方式。」
而且,Muse Glimmer 就是从 Meta 自己的 Muse Spark 中蒸馏出来的。小扎呼吁,美国政策必须放宽对训练数据和蒸馏技术的限制,否则美国开源AI将失去竞争力。
而且他认为,限制美国开源模型并不能解决任何问题,反而会削弱美国在 AI 生态上的话语权。
他警告,如果主动设限,其他国家的开源新星会迅速填补空白,让美国失去定义全球AI标准的机会。
同时,他提出一个折中方案:不去卡开源模型的发布,而是让实验室提前向政*分享「中间训练检查点」。

今天,让我们记住小扎,记住Meta。
他们用Muse Glimmer本地模型,向所有人证明:超级智能不必高高在上,它完全可以放在每一个人的包里。
参考资料:
https://www.meta.com/thefutureisforeveryone/
https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
编辑:Aeneas
声明:本文转载自新智元,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!
AI 中文社