Meta高管否认Llama 4模型基准测试作弊Meta 生成式人工智能总裁艾哈迈德·阿尔·达赫勒在X的一篇帖子中表示，Meta使用测试集来训练Llama 4 Maverick和Llama 4 Scout模型的说法 “根本不属实”

Meta高管否认Llama 4模型基准测试作弊

Meta 生成式人工智能总裁艾哈迈德·阿尔·达赫勒在X的一篇帖子中表示，Meta使用测试集来训练Llama 4 Maverick和Llama 4 Scout模型的说法 “根本不属实”。在人工智能基准测试中，测试集是用于在模型训练完成后评估其性能的数据集合。在测试集上进行训练可能会人为地提高模型的基准测试分数，从而使模型看起来比实际更强大。阿尔·达赫勒承认，部分用户在使用不同云服务提供商提供的 Maverick 和 Scout 模型时遇到了“质量参差不齐”的情况。由于我们在模型准备好后就立即发布了，我们预计需要几天时间才能让所有公开实现版本都调整到位。我们将继续进行错误修复并与合作伙伴进行对接。

—— Techcrunch

via 风向旗参考快讯 - Telegram Channel