前段时间,斯坦福大学人工智能研究院(Stanford HAI)发布了一份报告,表示美国在大模型领域遥遥领先。
报告指出,2023 年 61 个著名的人工智能模型来自美国的机构,远远超过欧盟的 21 个和中国的 15 个。
OpenAI 早期投资人 Vinod Khosla 去年还曾在 X 发文称,美国的开源模型都会被中国抄袭。
然而,一直被认为在「追赶美国」的国产大模型现在却成了被抄袭的对象,而这个抄袭的 AI 团队,正是来自发布上述报告的斯坦福大学。
斯坦福 AI 团队主导的 Llama3-V 开源模型,被揪出涉嫌抄袭国内清华&面壁智能的开源模型「小钢炮」MiniCPM-Llama3-V 2.5,瞬间在 AI 圈里炸开了锅。
在实锤之下,斯坦福团队也不得不紧急道歉。
正如面壁智能 CEO 李大海调侃式的回应,这是一种「受到国际团队认可的方式」。无论我们距离最顶尖的大模型还有多少差距,但国产大模型已经到了不能再被忽视的阶段。
简单梳理一下时间线:
斯坦福 AI 团队发布 Llama3-V,号称 SOTA 多模态大模型
网友质疑该模型抄袭国内面壁智能 MiniCPM-Llama3-V2.5
质疑证据涌现,Llama3-V 作者上演「删库跑路」
面壁智能官方实锤抄袭,深夜给出声明
Llama3-V 作者正式道歉,网友各持己见
抄袭面壁智能「小钢炮」,斯坦福 AI 团队上演「删库跑路」
近日,一个斯坦福 AI 团队宣布,只需 500 美元就可训练出一个超越 GPT-4V 的 SOTA 多模态大模型。
但很快,X 用户 @yangzhizheng1 指出,该项目使用的模型结构和代码与面壁智能不久前发布的 MiniCPM-Llama3-V2.5 惊人地相似。
为此,X 用户 @yangzhizheng1 也放出了相应的质疑证据。
证据一:
Llama3-V 和 MiniCPM-Llama3-V 2.5 的模型结构、代码,简直是复制粘贴级别的相似,区别大概就是换了个马甲——变量名改了改。
就像是同一件衣服,只是换了不同颜色的纽扣,你说巧不巧?
证据二:
Llama3-V 的作者被问到为啥能提前用上还没发布的 MinicPM-Llama3-V2.5 分词器时,他们解释称,用的是面壁智能上一代 MinicPM-V-2 项目。
但有媒体向面壁智能官方求证,在 HuggingFace 中,MiniCPM-V2 与 MiniCPM-Llama3-V 2.5 分词器分别是两个文件,文件大小也完全不同。
更何况,MiniCPM-Llama3-V 2.5 的分词器是用 Llama3 分词器加上 MiniCPM-V 系列模型的特殊 token 组成。
考虑到 MiniCPM-V2 的发布时间早于 Llama3,理论上它不可能包含尚未公开的 Llama3 分词器技术。
证据三:
更离谱的是,llama3-V 项目的作者面对用户的质疑,一看事情不妙,干脆上演了一出「删库跑路」的好戏。
连 GitHub 上的项目页面都撤了,堪称掩耳盗铃 2.0 版本。
Hugging Face 地址如下,目前打开该页面,我们只能看到「404」。
https://huggingface.co/mustafaaljadery/llama3v/commit/3bee89259ecac051d5c3e58ab619e3fafef20ea6
这还没完,更多证据正在不断涌现:
X 用户 @yangzhizheng1 表示如果往 MiniCPM-Llama3-V 2.5 的 checkpoint 添加高斯噪声(由单个标量参数化),出来的模型跟 Llama3-V 就像是一个模子刻出来的。
不仅如此,这模型还能识别「清华简」这种深奥的战国古文字,而且错得都一模一样,用面壁智能官方的话来说:
不仅对得一模一样、连错得都一模一样。
要知道这一古文字数据,是面壁智能和清华大学自然语言处理实验室团队花费数月时间,从清华大学收藏的清华简上逐字扫描并人工标注得来,从未对外公开过。
那斯坦福 AI 团队是如何凭空获得呢?
可以说,面壁智能的连番声明算是彻底实锤了斯坦福 AI 研究团队的抄袭。
直到今天凌晨,斯坦福 Llama3-V 团队的两位作者 Siddharth Sharma 和 Aksh Garg 在社交平台 X 上就这一学术不端行为向面壁 MiniCPM 团队正式道歉, 表示 Llama3-V 模型将悉数撤下。
名校学霸也抄袭?中国开源大模型正迎头赶上
此事之所以在网络上激起千层浪,一个重要的原因在于抄袭作者的背景实在光鲜。
公开信息显示,Siddharth Sharma 与 Aksh Garg 均是斯坦福大学计算机系的本科生,曾发表过机器学习领域的相关论文。
其中,Siddharth Sharma 曾在亚马逊实习过一段时间,目前主要从事于 AI 和数据相关工作。
而 Aksh Garg 的实习履历,那叫一个丰富,涵盖 SpaceX、斯坦福大学和加州理工学校等知名企业机构。
至于被这上述两位作者称为「代码搬运工」的 Mustafa Aljadery,是南加州大学出身,在舆论发酵之后,目前 X 账号已经被设为隐私状态。
对于斯坦福 Llama3-V 团队的道歉声明,眼尖的网友却不吃这套。
例如,X 用户 @xunie 指出,这哥俩将责任归咎给一个人的甩锅行为,莫不是「有福同享,有难你当」?
斯坦福 AI 实验室主任 Christopher David Manning 也站出来谴责这一抄袭行为,并且对 MiniCPM 这一优异的中国开源模型表示赞扬。
不过,也有网友抱着「得饶人处且饶人」的态度,悠悠然地鼓励道:
开放和诚实是科技界非常重要的价值观,期待你的新作品。
Google DeepMind 研究员 Lucas Beyer 表示,中国开源大模型拥有像 MiniCPM 这样好的模型,但国际上却没给够应有的关注……
面壁智能团队也于昨天对此事进行回应。
面壁智能 CEO 李大海表示:「技术创新不易,每一项工作都是团队夜以继日的奋斗结果,也是以有限算力对全世界技术进步与创新发展作出的真诚奉献。
我们希望团队的好工作被更多人关注与认可,但不是以这种方式。」
面壁智能首席科学家刘知远也在知乎上发文表示,表示这次事件从另一个角度证明了中国创新成果的国际影响力,强调了开源共享的重要性,以及对原创精神的尊重。
不得不说,这出 AI 圈的抄袭大戏,教科书般地诠释了叫「创新不易,且行且珍惜,学术诚信,人人有责」。
要知道,模仿了代码的形,却抄不来那份原创的风姿卓绝。
事实上,自去年以来,中国大模型如同雨后春笋般陆续开源,从以往的受益者转变为贡献者,不吝于向世界提供更多开源的优异成果。
上至阿里巴巴、腾讯等巨头,下至面壁智能,智谱 AI 、昆仑天工等 AI 初创,也都是开源社区的积极分子,为中国大模型的发展添砖加瓦。
我们也盼着,这股子开放共享的春风,能吹得更猛烈些。
正如面壁智能 CEO 李大海所呼吁的那样,大家一起共建开放、合作、有信任的社区环境。加油合作,才能让世界因 AGI 的到来变得更好!
来源:凤凰网科技,APPSO
本页面二维码
© 版权声明:
本站资讯仅用作展示网友查阅,旨在传播网络正能量及优秀中华文化,版权归原作者所有。
如有侵权请 联系我们 予以删除处理。
其他事宜可 在线留言 ,无需注册且留言内容不在前台显示。
了解本站及如何分享收藏内容请至 关于我们。谢谢您的支持和分享。
猜您会读:
-
在中国汽车工业的辉煌历程中,红旗品牌再次书写了浓墨重彩的一笔。红旗宣布成功下线首台国产氢能发动机,这一突破性的成就让全球汽车界为之震撼。长久以来,氢能源汽车因其清... 2024-06-30
- 李海燕/文80年代的“行”和2000年以后的“不行”众所周知,日本半导体产业经历过80年代的辉煌,也有之后的缓慢退步。但是如果简单地认为日本半导体产业失败了,是严重的误解。... 2024-06-28
- 从昨天晚间至今,已有多名用户收到了来自OpenAI的邮件。该邮件表示,“我们的数据显示您的组织来自OpenAI目前不支持的地区的API流量。”邮件进一步表示,自7月9日起,OpenAI将... 2024-06-26
-
壹 我宁愿亲眼见证人类被毁灭里克:我们首先来谈谈人工智能,我注意到你对人工智能的看法既带有乐观也含有悲观情绪。那么,让我们首先聚焦乐观的方面,人工智能是否真的会... 2024-06-22
-
光刻机“基石”技术成功突破!我国距摆脱“卡脖子”,还有多远?
要说我国现在工业制造领域还有什么求而不得的东西,大概就是高端的光刻机了吧。然而好消息是,被称为光刻机“基石”的减振器,近日已被我国工程院院士成功突破,彻底打破了被... 2024-06-22 -
中国航天员成功完成出舱活动,并且还小小的创造了一个新记录,太空行走八个半小时,它打破了中国航天的太空行走时长,并且位居世界第二,和排名第一的美国宇航员,只差了20多... 2024-06-18
-
国台办希望美国人英伟达首席执行官(CEO)黄仁勋好好补补课!
希望他多了解一些有关国家、历史事实的来龙去脉。文 | 海上客在昨天(6月12日)国台办例行记者会上,国台办发言人陈斌华在回答提问记者有关英伟达首席执行官(CEO)黄仁勋... 2024-06-14 -
当中国被限制购买国外制造的科技产品时,寻求开发自己的半导体设备是 "合乎逻辑的"
01谁说科技无国界?一定是有的,而且这个界比万里长城还难谁说科技无国界?一定是有的,而且这个界比万里长城还难,谈到光刻机就被卡住了,大家都咽不下这口气吧?引用路透社去年4月... 2024-06-11 - 2021年,林毅夫先生参加论坛时说,如果ASML不卖中国光刻机,中国三年就会生产出来。最近我看很多人阴阳怪气的出来说,三年过去了,光刻机在哪里?中国的光刻机让我看一看。说... 2024-06-09
-
嫦娥六号回家了!嫦娥七号准备中,合作名单被疯抢,选了7国合作
嫦娥六号完成人类首次从月球背面采集月壤!并且已经起身回家了。然而,在嫦娥六号任务之下,不少人也看到了国际合作的任务,这些国家可能也会率先获得样品,后续可能还会有更... 2024-06-07
-
► Jacques Baud 前瑞士战略情报局 安宁(译)|知远战略与防务研究所本文作者是曾被借调北约五年、领导打击小武器扩散的斗争的战略情报... 2022-05-04
-
看到这一幕,还是很感慨的。一个菲律宾的成年人,在北京的论坛上哭了,哭得那么伤心和痛心。为什么?他应该感受到了战争脚步的临近,他为自己国家的前途命运担忧。看观察者网... 2024-06-30
-
在中国汽车工业的辉煌历程中,红旗品牌再次书写了浓墨重彩的一笔。红旗宣布成功下线首台国产氢能发动机,这一突破性的成就让全球汽车界为之震撼。长久以来,氢能源汽车因其清... 2024-06-30
- 美叫嚣“把台海变无人地狱”,国防部:他们要做好先下地狱的准备财联社6月27日电,国防部6月27日下午举行例行记者会,国防部新闻局局长、国防部新闻发言人吴谦大校答记者问。... 2024-06-28
-
违法所得591元,罚款达1800多万?国家外汇局青岛分局:处罚没有问题
大皖新闻消息,“违法所得591.63元,罚款1863.89万元”。近日,国家外汇管理局青岛市分局的一则行政处罚决定书引起公众关注。在国家外汇管理局网站上,大皖新闻记者找到了这份... 2024-06-28 - 从昨天晚间至今,已有多名用户收到了来自OpenAI的邮件。该邮件表示,“我们的数据显示您的组织来自OpenAI目前不支持的地区的API流量。”邮件进一步表示,自7月9日起,OpenAI将... 2024-06-26
- 2024年6月23日消息:国家事业单位登记管理局发布通告,对中国管理科学研究院作出撤销登记。通告全文如下:经查,中国旅游文化资源开发促进会举办的中国管理科学研究院存在不按... 2024-06-24
- 近日,市场监管总局(国家反垄断局)发布的《中国反垄断执法年度报告 (2023)》透露了这样一组数据:2023年全国查处垄断协议、滥用市场支配地位案件27件,罚没金额21.63亿元... 2024-06-23
-
6月18日,以色列军方批准了对黎巴嫩真主党发动进攻的“作战计划”。次日,以军使用白磷弹攻击黎巴嫩东南部村镇。白磷弹实际上一种违禁武器,早在1980年通过的《联合国常规武器... 2024-06-22
-
最高死刑!依法严惩“台独”顽固分子分裂国家犯罪意见发布施行(附全文)
6月21日,最高人民法院、最高人民检察院、公安部、国家安全部、司法部联合发布《关于依法惩治“台独”顽固分子分裂国家、煽动分裂国家犯罪的意见》,自发布之日起施行。《意见... 2024-06-22