美国闭源前沿模型与中国开源权重模型性能差距缩小至约 4.4 个月
Mozilla 发布的《State of Open Source AI》报告显示,美国闭源前沿模型与中国开源权重模型之间的性能差距已缩小至约 4.4 个月。Moonshot AI 的Kimi K3 在Artificial Analysis Intelligence Index 综合得分上仅落后 Anthropic Fable 5 三个点,成本为 Anthropic Fable 5 的约 30%。METR 测算显示,最强闭源模型可稳定完成时长约 12 小时的人类专家任务,最强开源模型可完成约 7小时任务,预计约 4个月后开源模型将追上当前闭源水平。(来源:Ars Technica)