Mozilla 报告显示:中美 AI 模型能力差距缩短至 4.4 个月

来源:环球网2026-09-17 10:49

【环球网科技综合报道】9月17日消息,Mozilla近日发布第二版《开源 AI 现状》报告,通过多维度测评研判全球人工智能模型发展态势,报告指出,我国企业研发的顶尖开放权重 AI 模型,与美国科技企业前沿闭源 AI 模型之间的能力差距,已经缩短至 4.4 个月。

相较于今年 7 月发布的首版报告,本次第二版报告把研判视角进一步聚焦,围绕具体模型性能、任务处理时长、单任务运行成本等维度开展量化分析,更加直观展现开源与闭源 AI 赛道的发展格局。

报告重点关注了月之暗面推出的 Kimi K3 开放权重模型。测评数据显示,该模型在 Artificial Analysis 智能指数测评中得分,仅比 Anthropic 的 Fable 5 闭源模型低 3 分,但运行成本仅约为后者的 30%,展现出优异的性能成本比。

在长任务处理能力层面,报告引用 METR 测评体系,以 50% 的任务可靠完成率作为基准衡量模型的任务时间处理上限。当前全球顶尖闭源模型能够可靠完成约 12 小时时长的复杂任务,而最优开放模型可稳定处理 7 小时任务,前者任务处理时长约为后者的 1.7 倍。

Mozilla 首席技术官 Raffi Krikorian 表示,开源、闭源模型各有适用场景。闭源模型的优势,更多集中在需要 8 至 12 小时完成的高复杂度专业任务场景;开源模型则凭借成本优势,足以高效应对大量日常业务工作。按照当前迭代节奏推算,4 个月之后,开源模型将具备处理 12 小时任务的能力,届时闭源模型的长任务处理能力有望达到 20 小时。现阶段,8‑12 小时区间的重度复杂任务,依旧是闭源模型相对占优的领域。

模型能力的变化,正在带动企业端 AI 应用格局发生改变。据报告介绍,海外企业 DoorDash 已经采用 Kimi 模型承接日常业务,同时保留 Fable 模型处理高难度复杂工作。2026 年 8 月,在路由平台 OpenRouter 按 token 调用量统计的前十位模型中,开源模型占据八席,开源 AI 的产业落地规模持续扩大。

报告同时提示,要厘清 “开源” 与 “开放权重” 两个不同概念。不少对外提供模型权重下载的产品,并不完全满足开源定义,在数据来源、代码开放、使用许可等方面仍存在各类限制,在技术应用与产业采购中应当加以区分甄别。(纯钧)