您的当前位置:首页>科技咨询>资讯详情

Meta 高管澄清:新 AI 模型 Llama 4 训练“作弊

发表于:2025-04-08 10:00:12 浏览:11次 发布者: 网易科技

IT之家 4 月 8 日消息,Meta 公司的一位高管出面澄清了一则关于公司新 AI 模型的不实传言。该传言声称 Meta 在其新推出的 Llama 4 Maverick 和 Llama 4 Scout 模型上存在不当行为,即通过在特定基准测试的“测试集”上进行训练来提升模型的测试表现,同时隐藏模型的不足之处。


Meta 公司生成式人工智能副总裁艾哈迈德・阿尔・达赫勒(Ahmad Al-Dahle)在社交平台 X 上发表声明称,这种说法“根本不属实”

在人工智能领域,测试集是用于在模型训练完成后评估其性能的数据集合。如果在测试集上进行训练,可能会人为地提高模型的基准测试分数,从而使模型看起来比实际更强大。


值得一提的是,Maverick 和 Scout 在某些任务上的表现不佳,以及 Meta 选择使用未发布的实验版本 Maverick 来在基准测试平台 LM Arena 上获得更好成绩的决定,都为这一谣言提供了“燃料”。研究人员观察到,可公开下载的 Maverick 与在 LM Arena 上托管的模型在行为上存在显著差异。

阿尔・达赫勒承认,部分用户在使用不同云服务提供商提供的 Maverick 和 Scout 模型时,确实遇到了“质量参差不齐”的情况。他解释道:“由于我们在模型准备好后就立即发布了,我们预计需要几天时间才能让所有公开的实现版本都调整到位。我们将继续进行错误修复并与合作伙伴进行对接。”

猜你喜欢

热议 | 转人工客服,咋越来越难了?
热议 | 转人工客服,咋越来越难了?
发表于:2024-11-04 浏览:31 发布者: 网易互联网
东方购物打造“白玉兰直播间”,赋能“文旅商体
东方购物打造“白玉兰直播间”,赋能“文旅商体
发表于:2025-02-19 浏览:18 发布者: 网易互联网
Windows蓝屏事故半年后,留给Crowdstrike多少后
Windows蓝屏事故半年后,留给Crowdstrike多少后
发表于:2025-03-06 浏览:14 发布者: 网易互联网
出海记丨“加强海外仓建设”
出海记丨“加强海外仓建设”
发表于:2025-03-21 浏览:15 发布者: 网易互联网
抖音电商推出史上力度最大的商家扶持计划 9条措
抖音电商推出史上力度最大的商家扶持计划 9条措
发表于:2025-01-06 浏览:49 发布者: 网易互联网
娃哈哈重回700亿销售规模,宗馥莉稳了?
娃哈哈重回700亿销售规模,宗馥莉稳了?
发表于:2024-11-16 浏览:49 发布者: 联商网linkshop
焦虑的美国人“挤爆”敦煌网,中国卖家火速入驻
焦虑的美国人“挤爆”敦煌网,中国卖家火速入驻
发表于:2025-04-16 浏览:13 发布者: 网易互联网
刘强东进军外卖,美团、饿了么接招
刘强东进军外卖,美团、饿了么接招
发表于:2025-02-21 浏览:18 发布者: 网易互联网
这是什么梗丨回答我
这是什么梗丨回答我
发表于:2025-03-28 浏览:15 发布者: 网易互联网
抖音将建立安全与信任中心,推进算法和平台治理
抖音将建立安全与信任中心,推进算法和平台治理
发表于:2025-01-03 浏览:45 发布者: 网易互联网