GPT-3.5最强开源平替,OpenBuddy发布700亿参数跨语言大模型!
今天我们正式发布OpenBuddy-LLaMA2-70B大语言模型!这是迄今为止我们训练出的最大参数规模模型。
模型具备强认知能力和代码能力,可以基于用户的提问,写出相当复杂、多层嵌套的SQL语句:
同时,模型甚至涌现出了一定程度的复杂内容创作能力。例如,模型能够理解古诗词的含义并进行改编和创作。
OpenBuddy的开源历程:用开源激发中国大模型行业的潜能
从最初的7B模型到现在的70B模型,我们一直坚持开源的理念,并不断实践、改进,针对性地提升大语言模型的跨语言能力和认知能力。
在我们不断探索、实践跨语言模型的训练、调优方法的过程中,我们成功地基于LLaMA1、Falcon、OpenLLaMA、LLaMA2等多种基座,训练出来了规模、领域、应用场景各不相同的多种模型。
与此同时,得益于其广泛而活跃的社区,OpenBuddy在全球范围内受到了广泛的关注和应用。在我们开源的模型基础之上,OpenBuddy开源社区中的研究者、开发者通过接入知识库和进一步微调模型等多种方法,已经成功地将OpenBuddy模型应用于多个垂直领域和应用场景。
这些来自社区的努力不仅为我们带来了巨大的成就感,也正在从实践上进一步推动中国大模型行业的繁荣和可持续发展。
3B-70B全覆盖:多模型多场景
时至今日,OpenBuddy已经推出了3B、7B、13B、30B、40B、65B、70B等多种规模的模型,覆盖了从个人学习到商业应用,从边缘计算到高性能GPU集群,从轻量垂直模型到大型通用模型等多种应用场景。
3B模型:虽然参数量相对较少,但该模型仍然具备一定程度的认知能力,在嵌入式和边缘计算场景中具备应用潜力。
7B和13B模型:这两款模型在文本生成和多轮对话方面表现出色,特别是13B模型在中文内容创作、知识库问答等任务上具有明显优势。
30B模型:该模型在多项任务上展示了卓越的性能,特别是在Huggingface排行榜上,它的性能能够接近比它大得多的模型。
65B/70B模型:65B/70B模型不仅在Alpaca_Eval等各大排行榜上表现出色,还在推理、阅读理解等方面显示出卓越的潜力。这一切都归功于我们近半年的研发努力和巨大的数据支持。
以上模型均已上传至Huggingface,且部分热门模型已上传ModelScope。用户可以直接下载、部署。同时我们也提供多种测试、体验模型的方式。欢迎点击“阅读原文”访问我们的GitHub查看:
开源声明:共享共赢,忠于初心
在取得这样骄人的成绩后,我们决定将70B模型以可商用的形态全面开源(受LLaMA2协议限制,月活跃用户数须小于7亿)。欢迎点击“阅读原文”,访问我们的GitHub,根据指引从ModelScope或Huggingface上下载我们的OpenBuddy-LLaMA2-70B模型。
GitHub:https://github.com/OpenBuddy/OpenBuddy
这里要明确一点,我们的初衷绝非为了在各大排行榜上博得眼球,而是希望这份先进的技术能服务于更广泛的群体。作为一个开源项目,我们并不热衷于让模型去参加“做题式”的榜单,这是因为训练大模型用于“背诵答案”本身并不困难,但这种为封闭考试优化的模型并不真正能够赋能到各行各业,提升大模型所理应具备的认知推理能力和开放领域回答问题的能力才是正途。我们相信,随着开源可商用模型的不断进步,越来越多的个人和企业都将能以便捷而公平的方式从AI技术进步中获益。
“授人以鱼,不如授人以渔。”在发布开源模型的同时,我们也希望我们的模型能够真正赋能于各行各业,为不同背景、不同领域的需求提供服务。我们欢迎研究者、大模型爱好者加入我们的开源社区,共同分享基于OpenBuddy模型的调优和商业应用经验,这也有助于我们未来产出更加切合实际需要的开源模型。欢迎关注“开源智友”公众号,发送“加群”获得社区微信群邀请。
One More Thing: 15B代码模型
在结束这篇文章前,我们还有一个消息要与大家分享:基于StarCoder的15B代码模型:OpenBuddy-Coder-15B也正式发布了!StarCoder作为一个在代码生成领域有着广泛应用和影响力的开源预训练模型,为模型训练提供了坚实的基础。
请注意,受现有技术限制,模型存在固有的局限性,可能会输出有误导性或有害的内容,在使用时应当重视此类局限性。在下载模型前,请充分阅读并同意模型页面中的免责声明和授权协议。