【#李开复AI公司回应大模型抄袭#:尊重开源社区的反馈,将更新代码】11月14日,针对开源社区Hugging Face提出的“除了两个张量被重命名外,大模型Yi完全使用了 Llama 的架构”一事,零一万物向21世纪经济报道记者回应称,“在大量训练实验过程中,由于实验执行的需要对代码做了更名,我们尊重开源社区的反馈,将代码进行更新,也更好的融入Transformer生态。”
11月初,由创新工场董事长兼CEO李开复创办的AI公司“零一万物”正式发布了开源大模型“Yi”。当时,对于为何选择做开源大模型,李开复表示,“零一万物的发展受益于此前开源社区的一些集体智慧,这也让我们有义务去做一些贡献”。
在回应中,零一万物也表示,GPT是一个业内公认的成熟架构,Llama在GPT上做了总结。零一万物研发大模型的结构设计基于GPT成熟结构,借鉴了行业顶尖水平的公开成果,由于大模型技术发展还在非常初期,与行业主流保持一致的结构,更有利于整体的适配与未来的迭代。同时基于零一万物团队对模型和训练的理解做了大量工作,也在持续探索模型结构层面本质上的突破。
其同时强调,模型结构仅是模型训练其中一部分。Yi 开源模型在其他方面的精力,比如数据工程、训练方法、baby sitting(训练过程监测)的技巧、hyperparameter设置、评估方法以及对评估指标的本质理解深度、对模型泛化能力的原理的研究深度、行业顶尖的 AI infra 能力等,投入了大量研发和打底工作,这些工作往往比起基本结构能起到更大的作用跟价值,这些也是零一万物在大模型预训练阶段的核心技术护城河。据记者了解,Yi团队开源总监也在Hugging Face社区中表达了歉意,称“这个命名问题是工作疏忽。在大量的训练实验中,团队对代码进行了重命名以满足实验要求,但是在发布版本之前没有将它们切换回来。对此很抱歉。”(21世纪经济报)
发布于:陕西
相关推荐
李开复AI公司回应大模型抄袭:尊重开源社区的反馈,将更新代码
李开复旗下“零一万物”大模型被指抄袭LLaMA
阿里云领投李开复 AI 公司新一轮融资,首款大模型正式发布
李开复筹办的AI大模型公司“零一万物”上线,百亿级模型已内测|钛媒体焦点
AI战「疫」:百度开源业界首个口罩人脸检测及分类模型
GitHub遭抵制:AI 代码生成神器竟成“抄袭工具”?
李开复大模型公司“零一万物”官网上线:打造全新的 AI 2.0平台
Meta的大模型开源后,国产大模型在卷什么?
开源社区的暗面
开源大模型领域最重要的玩家们,在关心/担心什么
网址: 李开复AI公司回应大模型抄袭:尊重开源社区的反馈,将更新代码 http://m.xishuta.com/newsview97990.html