事时观察 · AI开源战局|2026-08-11 阿里巴巴(中国)的Qwen被Meta点名对标:开源30B本地Agent来了,编码榜仍输给Qwen3.6 8月10日,Meta以Apache 2.0协议开源约296亿参数的本地Agent模型Muse Glimmer,量化后约17GB、一张24GB显存显卡即可跑通。Meta官方给出的对比表里,第一个参照系就是阿里巴巴(中国)旗下通义千问的Qwen3.6-27B——而一周前,阿里刚把2.4万亿参数的Qwen3.8-Max正式上线(GA)。 ① 这次开源了什么:一张24GB显卡上的“常驻Agent” Muse Glimmer是Meta超级智能实验室(MSL)从闭源旗舰Muse Spark蒸馏出的稠密模型:约296亿参数,配18亿参数视觉编码器,131K上下文,支持图文输入,具备规划、工具调用、自我检查与故障恢复的完整Agent能力,专为“全天候常驻运行的本地智能体工作流”设计。 投资界 约296亿 参数(报道口径多为30B) 131K 上下文窗口,支持图文输入 约17GB 4bit量化版,24GB显存单卡可跑 3.1倍 DFlash推测解码,RTX 5090上74.9→233.4 token/s 官方口径称,量化后在15项常用评测上平均精度损失约1%;另有技术博主的整理口径为0.2%,两处数字差异不小,需等量化版独立跑分核实。 微博科技博主长文 模型已兼容OpenClaw等Agent编排框架,对llama.cpp、MLX、ExecuTorch的优化“近期上线”。 派早报 ② Meta自测的对比表:赢Agent、输编码 基准(Meta自测,Thinking模式) Muse Glimmer 30B Qwen3.6-27B Gemma4-31B MCP Atlas(通用Agent) 75.5 62.5 54.2 DeepSearch QA 74.6 71.1 61.7 τ3-Banking 23.5 16.7 15.1 SWE-Bench Verified(编码) 76.0 77.2 — SWE-Bench Pro(编码) 51.2 落后于Glimmer 注:全部为Meta官方自测口径,截至发稿未见第三方独立复现。投资界原文指出,SWE-Bench Verified、TerminalBench 2.1等编码与终端场景,Glimmer仍落后于Qwen3.6-27B。 投资界 | 微博科技博主 | 36氪 ③ 靶心为什么是阿里 最有信息量的不是参数,而是Meta把谁写进了对比表。一个30B开源模型的“默认参照物”是阿里做的——这本身就是过去两年开源格局的注脚: 下载断层第一: 截至2026年3月,Qwen全球累计下载突破10亿次(Hugging Face单平台9.42亿),占全球开源模型总下载量50%以上;2026年2月单月1.536亿次,比榜单其后8家之和还多。 中国开源模型41%首超美国 | Qwen占六成 结构性反转: Hugging Face上中国开源模型下载占比41%,首次超过美国的36.5%;OpenRouter上中国模型流量2026年4月已占45%以上,而2024年底不到2%。 同上 为什么是27B这个档位: Qwen3.6-27B全系Apache 2.0,Q4_K_M量化后仅16.8GB,单卡消费级可跑,SWE-bench Verified 77.2分反超自家397B旗舰——正是“本地单卡+编码+Agent”这个Meta要打的地盘。 同上 历史镜像: Llama曾是开源默认选项,2025年底下载量被Qwen反超;如今Meta带着蒸馏过的旗舰回归。这是旧王反攻。 同上 ④ 120天反转:Meta的时间线 2026-04-08 MSL发布Muse Spark即闭源,理由涉及生物安全等高风险信号;Llama五年开源路线首次断裂,开发者不满、投资者失望。 微博科技博主 2026-08-05 Muse Spark 1.2发布(API约1.25/4.25美元每百万token),同期推出终端编码Agent Muse Code。 市场情报 2026-08-10 Glimmer以Apache 2.0开源;扎克伯格发万字长文挺开源、挺蒸馏(“任何可以被观察到的东西,人们都应该可以从中学习”),呼吁美国减少训练数据政策阻力,但仍主张维持芯片出口管制;宣布Muse Spark 1.2权重“很快”放出,并设立独立董事审核模型发布。 36氪 判读: 闭源旗舰继续走API收费,开源小模型重建社区信任——Meta用“大模型闭源、小模型开源”的两手押注,换回被四月决定砸掉的开发者信任。 ⑤ 量化1%换24GB,开发者买不买单 支持本地派 隐私、离线、免API计费、可定制、不受服务策略影响。常驻Agent按token计费是真实痛点——初创团队可以把Agent管线整体搬到本地,“不再按token给Anthropic或OpenAI交租”。 微博科技博主 反对派 24GB显存/统一内存是硬门槛,“并非每个人都负担得起”;官方测试用的RTX 5090价格达数千美元,短期算账订阅云端更划算。已有用户用32GB Mac mini跑通Glimmer,但完成任务速度较慢。 36氪 关键歧义: Meta拿Qwen3.6-27B做参照,但Qwen3.6已不是最新一代——2.4万亿参数的Qwen3.8-Max已于8月3日GA(定价2/6美元每百万token)。Glimmer的真正考试,是对下一代27B级模型。 36氪 | 市场情报 ⑥ 阿里怎么接:底牌、迭代与3800亿 底牌是生态广度: 全尺寸矩阵、全系Apache 2.0、20种非洲语言适配;魔搭社区汇聚2900万开发者、22万个模型。报道称一家全球大型银行已本地部署Qwen,以平衡Claude等高端模型的使用成本。 同上 | 人民日报仲音 迭代不停: Qwen3.8-Max(2.4万亿参数)7月预览、8月3日GA,官方表态正式版仍将开源;8月11日“阿里千问开放平台”上线。 同上 | 市场情报 | 派早报 投入换身位: 阿里正推进3800亿元AI基础设施建设并计划追加投入;为聚焦AI,连年利润15亿–20亿、整体估值70亿–90亿元的灵犀互娱都挂牌整体出售。 天眼查·新闻舆情 商业逻辑: Qwen不靠模型本身赚钱,靠企业级定制、私有化部署、云服务变现——下载份额是生态入口,不是收入。 同上 ⑦ 风险观察 蒸馏论战: 6月有传闻称“阿里用25000个假账户、2880万次API调用偷学Claude”——至今无Anthropic公告、无诉讼、无阿里回应,未证实。 天眼查·新闻舆情 扎克伯格此次公开为蒸馏正名,同时主张维持芯片管制:对靠开源+蒸馏路线发展的中国阵营,这是“一半减压、一半加压”。 迭代风险: 阿里被Meta当作“上一代”参照物;Llama被Qwen反超的历史说明开源王座易主只需一两年——这次轮到阿里的位置被挑战。 复现风险: 发布当日即有文章指出命名空间、许可证、命名历史三处与Meta惯例不符,且查不到第三方跑分;此后Hugging Face权重地址可查、社区已有人跑通,但独立复现仍缺,所有对比数据目前只有Meta一方口径。 ic.work质疑文章 | 36氪 档案侧: 在本次已核验的阿里巴巴(中国)有限公司当前可见档案范围内(工商、新闻舆情、风险模块),未见与蒸馏争议或本次开源竞争直接相关的裁判、处罚记录;风险模块可见内容以历年程序性公告为主,不构成对本次事件的直接风险证据。 天眼查·工商信息 ⑧ 下一步验证什么 Muse Spark 1.2权重何时落地——开源旗舰的性能与许可证,是Meta这轮反攻的真正弹药。 Glimmer第三方复现:llama.cpp/MLX/ExecuTorch优化上线后,24GB设备实测跑分与速度,量化掉点究竟是1%还是0.2%。 阿里下一代27B级模型的出牌时间——Qwen3.8-Max是2.4T旗舰,27B级更新才是正面回应。 采用率验证:本地常驻Agent的隐私/离线价值,能否对冲24GB硬件门槛,看社区与To B案例。 来源 投资界:Meta重返开源!30B本地Agent塞进24GB显存(原文) 36氪:小扎万字长文炮轰闭源,Meta正式重回开源模型路线 微博:关了四个月的门又开了——Meta开源30B本地模型详解 今日头条:Meta发布Muse Glimmer战略解读 ic.work:Meta发布Muse Glimmer?三个细节对不上号 人民日报仲音:国产开源大模型全球下载量突破100亿次 今日头条:中国开源模型HF下载占比41%首超美国,Qwen累计下载破10亿 今日头条:中国开源大模型HF下载破百亿,Qwen占六成 市场情报:AI产业本周10件大事(Qwen3.8 Max GA、Muse Spark 1.2发布) 东方财富·派早报:Meta发布Muse Glimmer、阿里千问开放平台上线 天眼查:阿里巴巴(中国)有限公司·工商基础信息 天眼查:阿里巴巴(中国)有限公司·新闻舆情 编辑部注:本稿涉及Glimmer与Qwen的对比数据均为Meta官方自测口径,截至2026年8月11日发稿,第三方独立复现跑分尚未公开。