7月18日,AI圈被一条重磅消息刷屏。一个名为“Basalt Labs”的中国实验室未做任何预热,突然发布Monolith-1.0模型,宣称登顶世界第一。其数据之炸裂令人咋舌:1.6万亿参数,HLE工具测试拿下99.44%,GPQA Diamond达95.9%,AIME 2025超过90%,甚至声称在12,288块Ascend 910C NPU上训练了60万亿tokens。这一成绩瞬间击碎了所有榜单记录,仿佛在宣告旧时代的终结。
然而,狂欢仅持续数小时,一场惊天反转随之而来。没有世界第一的模型,没有精英团队,也没有万亿参数。这竟是一场精心策划的“社会实验”。当人们冲向Hugging Face准备下载时,发现仓库内没有配置文件,更离谱的是上千个权重文件字节大小竟完全一致。所谓的1.6T模型,不过是Qwen2.5-7B的复制粘贴,用随机数据填充成3TB的“巨无霸”。而那个对答如流的网页Demo,实则是对DeepSeek模型API的套壳。
随着质疑声四起,Basalt Labs发布声明:“实验已结束”,承认一切皆为虚构。幕后操盘手是名叫Max Scherf的小哥。他在YouTube上发布了复盘视频,展示了造假全过程:首先,他租用廉价GPU,下载开源Qwen2.5-7B模型,通过收集榜单答案进行微调,从而“背”出高分;其次,伪造实验室、论文和庞大的模型文件;再次,利用AI生成技术术语论文,编造180人团队和辉煌履历;最后,通过Discord和KOL进行病毒式传播。
这场骗局吸引了15万浏览量和多位业内大佬的关注,甚至引发了关于中国AI技术封锁失效的担忧。Max Scherf直言,他想验证的是:只要包装足够精美、参数标得足够大、跑分足够高,行业究竟需要多久才会去审视模型本身。这场闹剧撕下了AI行业盲目崇拜指标、缺乏实质审查的遮羞布。讽刺的是,这场骗局虽然全是假的,但被用作底座的Qwen和DeepSeek模型却是真实的。这或许证明了,中国AI的真实实力已强大到足以被骗子拿来冒充“世界第一”,而不被轻易识破。
