Mozilla近日发布第二版《开源AI现状》报告,从模型性能、任务时长、运行成本等维度进行量化分析,指出中国企业研发的顶尖开放权重模型与美国前沿闭源模型的能力差距已缩短至4.4个月。
报告重点测评了月之暗面的Kimi K3开放权重模型。该模型在Artificial Analysis智能指数中仅比Anthropic的Fable 5低3分,但运行成本仅约为后者的30%,展现出优异的性能成本比。
在长任务处理能力上,报告引用METR测评体系,以50%可靠完成率为基准:当前顶尖闭源模型可处理约12小时复杂任务,最优开放模型可稳定处理7小时,前者约为后者的1.7倍。Mozilla首席技术官Raffi Krikorian表示,闭源模型优势集中在8至12小时的高复杂度专业任务,开源模型则凭借成本优势胜任大量日常业务。按当前迭代节奏推算,4个月后开源模型将具备处理12小时任务的能力,闭源模型则有望达到20小时。
模型能力变化正带动企业应用格局改变。海外企业DoorDash已采用Kimi承接日常业务,同时保留Fable处理高难度工作。2026年8月,在OpenRouter按token调用量统计的前十位模型中,开源模型占据八席,产业落地规模持续扩大。
报告同时提示,需厘清“开源”与“开放权重”两个概念:不少提供权重下载的产品在数据来源、代码开放、使用许可等方面仍有各类限制,技术应用与产业采购中应加以区分甄别。
