飞雪无情

GPT-3.5最强开源平替,OpenBuddy发布700亿参数跨语言大模型!

今天我们正式发布OpenBuddy-LLaMA2-70B大语言模型!这是迄今为止我们训练出的最大参数规模模型。

70B模型在能力表现上,相较于早前发布的较小规模模型,在文本生成、复杂逻辑推理以及自然语言处理等任务有了非常显著的提升。
据参与内测的社区成员反馈,以及我们的多项能力测试指标,70B的认知能力和逻辑推理能力,使其能够成为GPT3.5的开源平替!
在众多开源模型中,40B以内参数较小的模型虽然有部署成本低等优势,但和GPT-3.5相比,这些模型的认知能力存在明显差距,能够处理的任务场景会受到相应的限制。英文基座大模型,在处理中文相关的任务上相对较弱,但基座的推理能力普遍较好。完全基于中文数据训练的大模型,会具备很强的中文能力,但在处理复杂任务逻辑上则有提升空间。
OpenBuddy团队一直致力于训练具备中文等跨语言能力,且具有足够逻辑推理能力和认知能力的开源大模型。目前的70B模型所取得的效果是迄今为止最好的,在语言能力和逻辑推理能力上取得了非常好的平衡。
在如下测试例子中,70B模型表现出了对语言的深刻理解能力,在处理阅读理解任务时,模型能轻松理解字面意义背后的深层的含义,并能够回答用户的开放式问题。

Image

Image

模型具备强认知能力和代码能力,可以基于用户的提问,写出相当复杂、多层嵌套的SQL语句:

Image

同时,模型甚至涌现出了一定程度的复杂内容创作能力。例如,模型能够理解古诗词的含义并进行改编和创作。

Image

Image

OpenBuddy的开源历程:用开源激发中国大模型行业的潜能

从最初的7B模型到现在的70B模型,我们一直坚持开源的理念,并不断实践、改进,针对性地提升大语言模型的跨语言能力和认知能力。

在我们不断探索、实践跨语言模型的训练、调优方法的过程中,我们成功地基于LLaMA1、Falcon、OpenLLaMA、LLaMA2等多种基座,训练出来了规模、领域、应用场景各不相同的多种模型。

与此同时,得益于其广泛而活跃的社区,OpenBuddy在全球范围内受到了广泛的关注和应用。在我们开源的模型基础之上,OpenBuddy开源社区中的研究者、开发者通过接入知识库和进一步微调模型等多种方法,已经成功地将OpenBuddy模型应用于多个垂直领域和应用场景。

这些来自社区的努力不仅为我们带来了巨大的成就感,也正在从实践上进一步推动中国大模型行业的繁荣和可持续发展。

3B-70B全覆盖:多模型多场景

时至今日,OpenBuddy已经推出了3B、7B、13B、30B、40B、65B、70B等多种规模的模型,覆盖了从个人学习到商业应用,从边缘计算到高性能GPU集群,从轻量垂直模型到大型通用模型等多种应用场景。

3B模型:虽然参数量相对较少,但该模型仍然具备一定程度的认知能力,在嵌入式和边缘计算场景中具备应用潜力。

7B和13B模型:这两款模型在文本生成和多轮对话方面表现出色,特别是13B模型在中文内容创作、知识库问答等任务上具有明显优势。

30B模型:该模型在多项任务上展示了卓越的性能,特别是在Huggingface排行榜上,它的性能能够接近比它大得多的模型。

65B/70B模型:65B/70B模型不仅在Alpaca_Eval等各大排行榜上表现出色,还在推理、阅读理解等方面显示出卓越的潜力。这一切都归功于我们近半年的研发努力和巨大的数据支持。

以上模型均已上传至Huggingface,且部分热门模型已上传ModelScope。用户可以直接下载、部署。同时我们也提供多种测试、体验模型的方式。欢迎点击“阅读原文”访问我们的GitHub查看:

Image

开源声明:共享共赢,忠于初心

在取得这样骄人的成绩后,我们决定将70B模型以可商用的形态全面开源(受LLaMA2协议限制,月活跃用户数须小于7亿)。欢迎点击“阅读原文”,访问我们的GitHub,根据指引从ModelScope或Huggingface上下载我们的OpenBuddy-LLaMA2-70B模型。

GitHub:https://github.com/OpenBuddy/OpenBuddy

这里要明确一点,我们的初衷绝非为了在各大排行榜上博得眼球,而是希望这份先进的技术能服务于更广泛的群体。作为一个开源项目,我们并不热衷于让模型去参加“做题式”的榜单,这是因为训练大模型用于“背诵答案”本身并不困难,但这种为封闭考试优化的模型并不真正能够赋能到各行各业,提升大模型所理应具备的认知推理能力和开放领域回答问题的能力才是正途。我们相信,随着开源可商用模型的不断进步,越来越多的个人和企业都将能以便捷而公平的方式从AI技术进步中获益。

“授人以鱼,不如授人以渔。”在发布开源模型的同时,我们也希望我们的模型能够真正赋能于各行各业,为不同背景、不同领域的需求提供服务。我们欢迎研究者、大模型爱好者加入我们的开源社区,共同分享基于OpenBuddy模型的调优和商业应用经验,这也有助于我们未来产出更加切合实际需要的开源模型。欢迎关注“开源智友”公众号,发送“加群”获得社区微信群邀请。

One More Thing: 15B代码模型

在结束这篇文章前,我们还有一个消息要与大家分享:基于StarCoder的15B代码模型:OpenBuddy-Coder-15B也正式发布了!StarCoder作为一个在代码生成领域有着广泛应用和影响力的开源预训练模型,为模型训练提供了坚实的基础。

这款15B代码模型不仅拥有高度精准的代码生成能力,还具备代码理解和修复的潜力。对于软件开发者而言,这意味着一个更加智能、更加高效的编程助手即将走进他们的生活。一如既往,这款模型也将遵循开源的理念,让更多的开发者受益。

请注意,受现有技术限制,模型存在固有的局限性,可能会输出有误导性或有害的内容,在使用时应当重视此类局限性。在下载模型前,请充分阅读并同意模型页面中的免责声明和授权协议。