← 返回首页

Muse Glimmer 30B

Meta(Meta Superintelligence Labs)

Meta 首款开源权重的 Agent 模型(30B,Apache-2.0),Muse Spark 1.2 蒸馏,单张消费级显卡即可跑本地 Agent 工作流,2026-08-10 发布

开源 本地 模型API Agentic
A-
单卡可跑的开源 Agent 模型
⭐⭐⭐⭐

📖 产品简介

Muse Glimmer 30B 是 Meta Superintelligence Labs 于 2026 年 8 月 10 日发布的开源权重(open-weight)智能体模型,也是 Meta 闭源 Muse 系列(Spark、Muse Code)首个公开的开放权重条目,以 Apache 2.0 协议发布于 Hugging Face。

它由 Muse Spark 1.2 经 logit 蒸馏后,再经长上下文 mid-training 与 SFT / on-policy 蒸馏 / 跨推理·编程·Agent 领域的 RL 后训练而成,专为常驻本地的 Agent 工作负载设计:函数调用、本地编码、长时间工具调用、LLM-as-a-judge 评估。Glimmer 通过约 4-bit 量化把 30B 模型压缩到 20GB 以内,可在单张 24GB/32GB 消费级显卡(RTX 5090 / M5 Max / M4 Max)上运行,无需按 token 计费、数据不出本机。架构为稠密因果 Transformer(52 层,约 29.6B 语言参数 + 约 1.8B ViT-G/14 视觉感知编码器),128K 上下文,文本与图像输入,202K 词表;配合轻量 DFlash 投机解码在 RTX 5090 上最高实现 3.1x 解码提速。官方基准:SWE-Bench Verified 76.0、AIME 2026 94.7、GPQA Diamond 83.5、MCP Atlas(工具调用)75.5、Terminal-Bench 2.1 51.7,整体领先 Gemma 4 31B、与 Qwen3.6-27B 互有胜负。发布即日提供 transformers / llama.cpp / vLLM / MLX / ExecuTorch 的 Day-0 集成,Ollama、LM Studio、Together AI、Fireworks 后续跟进。Meta 同时预告 Muse Spark 1.2 旗舰模型的开放权重将在未来数周发布。

定位
Meta 首款开源权重的 Agent 模型(30B,Apache-2.0),Muse Spark 1.2 蒸馏,单张消费级显卡即可跑本地 Agent 工作流,2026-08-10 发布
适合人群
本地优先 / 隐私敏感开发者 独立开发者与小团队 Agent harness 构建者 边缘 / 离线部署场景
支持平台
本地(消费级 GPU)、API(第三方托管,后续)
开源

核心功能

  • 🖥️ 单卡可跑:约 4-bit 量化压缩至 20GB 以内,24GB/32GB 消费级显卡即可本地运行
  • 🤖 原生 Agent 工作负载:函数调用、长时工具调用、本地编码、LLM-as-a-judge
  • 👁️ 多模态:文本 + 图像输入,内置约 1.8B ViT-G/14 视觉感知编码器
  • 📜 Apache 2.0 开放权重:Hugging Face 可下载,数据不出本机、无按 token 计费
  • DFlash 投机解码:RTX 5090 最高 3.1x 解码提速,M5 Max 1.8x、M4 Max 1.5x
  • 🔌 Day-0 生态集成:transformers / llama.cpp / vLLM / MLX / ExecuTorch

⚖️ 优缺点分析

👍 优点

  • 首个 Muse 系列开放权重模型,Apache 2.0 商用友好
  • 单张消费级显卡即可本地运行,隐私与成本优势明显
  • 原生面向 Agent 工作负载设计,而非单纯聊天模型
  • Day-0 覆盖主流推理框架,落地门槛低
  • 与闭源 Muse Spark 1.2 同源,能力基准有背书
  • 无按 token 计费,长时任务边际成本趋近于零

👎 缺点

  • 仅官方模型卡基准,尚缺第三方独立评测交叉验证
  • Terminal-Bench 2.1(51.7)明显弱于 Qwen3.6-27B(60.7)
  • 需约 20GB 显存,入门级显卡(如 8GB/12GB)仍无法运行
  • Muse Spark 1.2 旗舰开放权重尚未发布,能力上限待观察
  • Agent 框架定位,仍需自行搭建 harness/工具链

📊 评分详情

功能完整
8
易用程度
9
安全可靠
9
性价比
10

💬 用户评价

Muse Glimmer 把 30B 的 Agent 模型压进单张显卡,本地跑工具调用、读截图、从错误里恢复,按 token 计费的云 Agent 第一次有了低成本替代。

📝 更新日志

  • 2026-08-10
    Muse Glimmer 30B 首发(开放权重)
    **Meta 首款开源权重 Agent 模型发布(Aug 10)**——30B 参数、Apache 2.0 发布于 Hugging Face,是 Muse 系列(Spark / Muse Code)首个公开开放权重条目。由 Muse Spark 1.2 经 logit 蒸馏 + 长上下文 mid-training + SFT/on-policy 蒸馏/跨推理·编程·Agent 的 RL 后训练而成,专为常驻本地 Agent 工作负载(函数调用、本地编码、长时工具调用、LLM-as-a-judge)设计。约 4-bit 量化压缩至 20GB 以内,单张 24GB/32GB 消费级显卡可跑;稠密因果 Transformer(52 层,约 29.6B 语言参数 + 约 1.8B ViT-G/14 视觉编码器),128K 上下文、文本+图像输入、202K 词表,DFlash 投机解码在 RTX 5090 最高 3.1x 解码提速。官方基准:SWE-Bench Verified 76.0 / AIME 2026 94.7 / GPQA Diamond 83.5 / MCP Atlas 75.5 / Terminal-Bench 2.1 51.7。Day-0 集成 transformers / llama.cpp / vLLM / MLX / ExecuTorch,Ollama、LM Studio、Together AI、Fireworks 后续跟进。Meta 同步预告 Muse Spark 1.2 旗舰开放权重将于未来数周发布