资讯
谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样
📋总体概括
分析机构SemiAnalysis发文指出,谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单上超越OpenAI、Anthropic旗舰模型的表现存在过拟合嫌疑,即针对评测集刷分。Meta AI负责人Alexandr Wang对此回应否认,并称OpenAI同样如此。榜单刷分在AI行业屡见不鲜,此前矛头多指向国产大模型,如今美国大厂同样被质疑,榜单公信力正被行业集体侵蚀。
⚡关键信息
- ▸SemiAnalysis指谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3存在过拟合,涉嫌针对榜单刷分
- ▸两款模型曾在AA榜单超越OpenAI、Anthropic旗舰大模型,表现引发意外
- ▸Meta AI负责人Alexandr Wang回应否认作弊,并反指OpenAI也一样
- ▸Wang为Scale AI创始人,Meta重金收购后执掌AI业务,Spark由其主导
- ▸AI榜单刷分并非新闻,此前指责多针对国产大模型,如今蔓延至美国大厂
🔥犀利点评
所谓刷分作弊,本质不是谁作弊,而是榜单本身已失去筛选价值。当评测集被各家公司反复逆向调优,跑分就成了针对性的应试训练,与真实能力脱节。Wang那句「OpenAI也一样」比否认更有信息量——等于承认整个行业都在刷。与其争论谁刷得更狠,不如看谁在真实产品和收入上站得住:榜单第一换不来API续费,商业落地才是唯一的硬跑分。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →