最近,学术圈因为一起AI模型抄袭风波引发广泛关注。斯坦福大学某AI研究团队近期开源的Llama3-V模型,被指涉嫌抄袭——抄袭对象正是清华系明星创业公司面壁智能的开源模型“小钢炮”MiniCPM-Llama3-V 2.5。这一事件迅速在网络发酵,成为热点话题。

图片来源:Pexels
事件经过如下:5月29日,一支斯坦福AI团队在网络上高调宣称,仅需500美元就能训练出一个超越GPT-4V的SOTA多模态大模型。听起来极具冲击力,但网友很快发现,该团队开源的模型结构与代码与“小钢炮”高度相似,唯一的区别只是改动了几个变量名称。
面壁智能团队于6月2日深夜确认了这一事实——斯坦福的模型不仅能准确识别出“清华简”中的战国古文字,甚至错误识别结果也与MiniCPM模型完全一致。关键点在于:这些古文字数据是面壁智能团队花费数月时间,从清华简上一字一字扫描并人工标注而成,且从未公开过。数据从未公开,斯坦福的模型却“恰好”识别出同样的错误?抄袭证据确凿。
北京时间今早1点27分,斯坦福Llama3-V团队的两位作者Siddharth Sharma和Aksh Garg终于在社交平台X上对面壁MiniCPM团队正式致歉,承认学术不端行为,并承诺将撤下所有Llama3-V模型。有意思的是,此前几个小时他们曾发布过一封类似内容的道歉信,但很快又删除了——这一操作,耐人寻味。
