Meta发布全新开源AI模型,提出从竞争对手数据中学习的思路,并抛出一个6000亿美元的问题
Meta
Google/DeepMind
Alibaba/Qwen
OpenAI
Anthropic
Meta已发布Muse Glimmer,一个300亿参数的开源AI智能体模型,采用Apache-2.0许可证,旨在消费者硬件上本地运行。扎克伯格在发布同时撰写了一篇文章,为蒸馏竞争对手模型的做法辩护,并倡导开放模型,而投资者则质疑Meta将如何从其庞大的基础设施支出中获利。
Meta发布了Muse Glimmer,这是一个拥有300亿参数的模型,权重在Hugging Face上以Apache-2.0许可开源,旨在让AI代理在配备单张消费级GPU的Mac或PC上本地运行。这是Meta自2025年春季Llama 4以来首个开源模型,公司计划在未来几周内发布其最强模型Muse Spark 1.2的开源权重版本。在沉寂期间,Meta在Llama 4因基准测试虚高而令人失望后,将其AI部门重组为Meta超级智能实验室,聘请了顶尖研究人员,投资了Scale AI,并失去了首席科学家Yann LeCun。Glimmer与谷歌的Gemma4-31B和阿里的Qwen3.6-27B相比具有竞争力,在大多数基准测试中领先,尤其是在智能体任务上,不过Qwen在桌面控制和终端任务方面更胜一筹。该模型被压缩到约4比特,以适应消费级GPU和MacBook的20GB内存限制,并配备一个小型辅助模型,将文本输出速度提升高达3.1倍。扎克伯格的博客文章《未来属于每个人》主张超级智能的广泛普及,并捍卫对其他公司模型进行蒸馏的做法,这种做法遭到OpenAI和Anthropic的批评,认为这是搭便车行为。他呼吁减少对训练数据的限制,并为安全检查提供早期模型访问权限。Meta的论点部分出于商业考虑,因为它在前沿模型方面落后于OpenAI和Anthropic。投资者质疑Meta将如何为到2028年6000亿美元的支出提供合理性,因为开源模型不产生许可收入;扎克伯格暗示了一种类似其广告业务的动态拍卖机制来分配计算资源,但细节尚不明朗。
来源: The Decoder (DE) —
原文
