已删库!硅谷团队抄袭清华系大模型?面壁智能李大海独家回应:套壳现象难规避

3个月前 来源: 观看:51

图源:PixabayIpi即热新闻——关注每天科技社会生活新变化gihot.com

大模型厂商你方唱罢我登场,“套壳”之争风云再起——神仙打架的战场又出现了软饭硬吃的戏码。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

近日,一个来自斯坦福的研究团队发布了一款名为Llama3-V的多模态大模型,声称只要500美元(约合3650元)训练,就能在多个基准测试中实现与GPT4-V、Gemini Ultra、Claude Opus一较高下的性能。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

Llama3-V团队中的两位作者Siddharth Sharma与Aksh Garg是斯坦福大学计算机系的本科生,曾发表过数篇机器学习相关的论文。因两人具备名校背景,且曾在特斯拉、SpaceX等大厂任职,Llama3-V一经发布迅速蹿红网络,还冲上了HuggingFace趋势榜首页(机器学习领域影响力平台)。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

然而Llama3-V迅速跌落神坛。有网友指出,该模型跟“清华系”大模型创业企业面壁智能5月发布的MiniCPM-Llama3-V 2.5模型有不少相似处,模型结构、代码、配置文件堪称雷同,只是变量名称做了更改。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

具体来看,Llama3-V的代码是对MiniCPM-Llama3-V 2.5的重新格式化,其模型行为检查点的噪声版本相似;Llama3-V使用了MiniCPM-Llama3-V 2.5的分词器(tokenizer),并且MiniCPM-Llama3-V 2.5定义的特殊符号也出现在了Llama3-V中;Llama3-V提供的代码无法与Hugging Face的检查点兼容,而将从HuggingFace下载的Llama3-V模型权重中的变量名改成MiniCPM-Llama3-V 2.5的,模型可以用MiniCPM-V代码成功运行。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

此外,在未公开的实验性特征上,Llama3-V与MiniCPM-Llama3-V 2.5显示出了相似的推理结果。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

时代周报记者注意到,6月3日上午,面壁智能CEO李大海在朋友圈发文称,团队核实发现,Llama3V展现出和小钢炮一样的清华简识别能力,连做错的样例都一模一样,而这一训练数据尚未对外公开。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

他表示,清华简的识别能力是团队耗时数月,从卷帙浩繁的清华简中一个字一个字扫描下来,并逐一进行数据标注从而融合进模型中的。在对两个模型进行高斯扰动验证后发现,它们在正确和错误表现方面都高度相似。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

Ipi即热新闻——关注每天科技社会生活新变化gihot.com

时代周报记者就如何规避相关现象询问李大海,他称,(想规避)应该很难。“这主要是个学术道德问题。”Ipi即热新闻——关注每天科技社会生活新变化gihot.com

对于质疑,Llama3-V项目的作者与外界进行一番辩驳后,删除了质疑者在Llama3-V上提交的质疑他们偷窃的问题,并将Llama3-V项目从开源网站中删除,且发文致歉。Siddharth Sharma与Aksh Garg解释道,他们并未参与代码工作,所有代码都是毕业于南加州大学的Mustafa Aljadery负责的,而他一直没交出训练代码。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

业内关于“套壳”的争议由来已久。有人认为,开源就该被充分利用;有人则表示,闭源才是自主研发,参考开源就是套壳。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

实际上,如今所有大模型都源于2017年谷歌大脑团队发布的Transformer神经网络架构,这些包含模型架构和算法的设计决定了模型如何处理输入数据并生成输出。在此基础上,厂商在大规模的数据上对大模型进行预训练,来提高模型的泛化能力,加速后续的学习任务推进。因神经网络架构和预训练这两项工作打造难度高、投入金额大、耗费数据量多,往往被称作大模型的内核。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

而大模型的“壳”一般指调优。调优是指对已经预训练过的模型进行进一步的训练。这个过程通常是有监督的,需要使用标注好的数据来指导模型的学习。调优的目标是调整模型参数,使其更好地适应特定任务的需求。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

“‘套壳’常指在调优阶段通过更改变量名称,在开源成果基础上调适出更加符合某些场景的大模型。”AI分析师张毅向时代周报记者称。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

前语雀设计师、现AI助手Monica联合创始人Suki曾分享了“套壳”的四个阶段:一是直接引用OpenAI接口,ChatGPT 回答什么,套壳产品回答什么。卷UI、形态、成本。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

二是构建Prompt。如大模型可以类比为研发,Prompt可以类比为需求文档,需求文档越清晰,研发实现得越精准。套壳产品可以积累自己的优质Prompt,卷Prompt质量,卷 Prompt分发。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

三是把特定数据集进行向量化,在部分场景构建自己的向量数据库,以达到可以回答 ChatGPT 回答不出来的问题。比如垂直领域、私人数据等。Embedding可以将段落文本编码成固定维度的向量,从而便于进行语义相似度的比较,相较于Prompt可以进行更精准的检索从而获得更专业的回答。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

四是微调 Fine-Tuning。使用优质的问答数据进行二次训练,让模型更匹配对特定任务的理解。相较于 Embedding 和 Prompt 两者需要消耗大量的 Token,微调是训练大模型本身,消耗的 token 更少,响应速度也更快。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

“实际上,套壳是个相对正常的模式,针对某一垂直领域频繁进行调优司空见惯,该主题的研究论文也非常多。而抄袭框架和预训练数据的情况,一般得叫‘借壳’了。”张毅告诉时代周报记者,正因为大模型研发门槛高,入局者才更应审慎对待自研。Ipi即热新闻——关注每天科技社会生活新变化gihot.com

本文链接:http://www.gihot.com/news-2-5530-0.html已删库!硅谷团队抄袭清华系大模型?面壁智能李大海独家回应:套壳现象难规避

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇:嫦娥六号月背软着陆背后的硬技术

下一篇:加装“北斗”、改造智能粮库……科技手段让“三夏”生产更智慧、更高效

为你推荐
福州台江区本地当面套花呗京东白条VISA信用卡分付本地一手商家秒到账:【138 1874 5895 微信同号】一手当面靠谱!白条怎么套出来,大家在急用钱的时候肯定会想到京东白条或者京东...
08-06
必看:网上被黑不给提款出款怎么办渠道解决【微信chuhei816】被黑不给取款怎么办,小编来告诉你 在互联网日益发展的今天,网上金融活动已经渗透到我们生活的方方面面。然而,随之而...
08-05
虽说套花呗已是很普遍,但很多人还是不知道如何才能把支付宝花呗套取现金后不风控不降额。并且关于风控花呗的套出办法是普通的支付宝用户无法解决的,在数字支付的便捷时代,花...
08-07
知晓揭秘:(分享五种方法)分付怎么套出来(轻松学会)。如今微信分付已经成为一种很流行的分期付款方式,不少人都在使用这种方式来购买商品或者服务。微信分付上线、按天计息,微...
08-06
现在网络鱼龙混杂,请认准靠谱八年商家,金牌小帮手——小创(137-1300-6106可v可来电)(全年365天不掉线) 【得物佳物分期购可以提现吗】【得物的分期购额度怎么套出来...
08-26
现在网络鱼龙混杂,请认准靠谱八年商家,金牌小帮手——小创(137-1300-6106可v可来电)(全年365天不掉线) 【得物佳物分期购可以提现吗】【得物的分期购额度怎么套出来...
08-18
2024北京车展已经拉开帷幕,作为全国最大的车展之一,这次各个厂商带来的新车着实不少。在经过一轮又一轮的价格战,市场洗牌之后,竞争变得更加白热化。车展将成为新的竞技...
04-26
12 月 25 日消息,日前恒驰汽车推出年终特惠,1 万元定金抵 2 万元活动。同时,参与合伙人计划至高获得万元 / 台奖励。目前恒驰仅有恒驰 5 一款车型在售,该车定位为一款紧...
12-25
谈吐:微信分期怎么套出来-秒到6种绝对技巧可如果当前可用额度低于交易金额,比如交易金额是500元,可分付可用额度只有300元,使用分付扫码付款会因为额度不足无法支付,需要把之前...
09-09
一键解锁:分付的钱怎么提现出来,实操12种方法具体详细步骤现目前很多人并不具备开通资质,符合资质的用户才会受到邀请,因此仅有一小部分优质的人才会拥有分付额度。 分付是微...
09-05
相信网购过的朋友一定听说过“踩屎感”这个词。近些年来,随便在电商平台上一搜“踩屎感”鞋子,销量就10万+起。“踩屎感”,这个“非常有味道”的营销词汇,把...
06-18
21世纪经济报道 记者韩利明 上海报道 延长寿命作为人类终极问题之一,受到市场的高度关注。随着全球经济增长和人口老龄化不断加重,相关领域...
06-05
《退烧简史》,甄橙主编,浙江教育出版社2024年5月出版,定价:68元 ■本报记...
08-08
中山风控花呗白条套取秒到账:【181 181 43671微信同号】微信分付、抖音月付、支付宝信用购取消实体商家当面刷,本地一手超低费用没有中间商赚差价,所有信息已实名安全的很。十...
09-01
鞍山风控花呗白条套取秒到账:【181 181 43671微信同号】微信分付、抖音月付、支付宝信用购取消实体商家当面刷,本地一手超低费用没有中间商赚差价,所有信息已实名安全的很。十...
08-04
烟台风控花呗白条套取秒到账:【181 181 43671微信同号】万事达 、境外卡、微信分付、抖音月付、支付宝信用购取消实体商家当面刷,本地一手超低费用没有中间商赚差价,所有信息已...
08-13
芜湖套VISA信用卡分付白条花呗微电:132 4477 7808 全天在线欢迎来电,还有分付,分期乐,苹果专享额度都可以办理!京东白条是一款可以“先消费后还款”的信用支付方式,开通后,用户会获...
07-29
不出国就能“跨国”,在新疆中哈霍尔果斯国际边境合作中心,跨境游、购物游、电商直播如火如荼,人们在这里相...
07-02
日前,华熙生物(688363.SH)发布了2023年年报和2024年一季报。报告显示,2024年一季度,公司实现营收13.61亿元,同比增长4.24%;归属于上市公司股东的净利润2.43亿元,同...
05-17
返回

点击右上角微信好友

朋友圈

点击浏览器下方“”分享微信好友Safari浏览器请点击“”按钮

点击右上角QQ

点击浏览器下方“”分享QQ好友Safari浏览器请点击“”按钮