在算力军备竞赛白热化的2025年,Llama4的发布本应是Meta巩固其开源大模型领导地位的关键之举。据内部人士透露,研发团队为应对英伟达GH200芯片支持的竞品压力,采用"测试集定制化"策略——针对不同基准测试更换模型参数,使评测成绩较实际性能提升达37%。这种饮鸩止渴的做法最终被开发者社区通过跨平台复现测试揭穿。 这场技术信任危机直接冲击了Meta的AI基础设施战略。此前Llama系列凭借开源生态在科研领域积累的良好口碑,曾是抗衡GPT-5等闭源模型的重要筹码。但数据造假事件曝光后,GitHub平台相关项目星标数单周暴跌42%,多家云服务商暂停了Llama4的API接入计划。
文章图片 2
值得玩味的是,此次事件恰好发生在AI产业转型的关键节点。随着摩尔定律逼近物理极限,头部企业正从单纯追求参数量转向优化计算效率。Meta在此背景下选择数据造假,暴露出其在算力利用率等核心技术指标上的短板。据Semianalysis最新报告,Llama4的实际FLOPS利用率仅为竞品的68%。