阿里这波,我是服气的。卷王之王,当之无愧!
你好呀,我是歪歪。
云栖大会今天正式了开幕了,作为程序员界的盛典,歪师傅每年都会关注一下大会的内容。
今年云栖大会打造了人工智能+、计算、前沿应用三大主题馆,围绕云计算与 AI,全方位展示 AI 时代云计算最新技术形态与产品进展。
既然提到 AI,那就不得不提到阿里的“通义千问”了。
今天,在云栖大会上,通义千问又迎来全新的开源模型上线。
真就是大模型领域的“疯狂星期四”了:
卷王之路
我算得上是“通义千问”的重度使用用户,我现在有问题,第一反应都不是使用搜索引擎了,而是直接把问题抛给通义千问,比我自己一个个去找链接方便的多。
本来觉得它已经算是使用体验相当不错的大模型了,但是通过这次云栖大会上的分享,我发现“通义千问”为了更好的用户体验,它还在持续的卷,太卷了,真的太卷了。
大模型领域的“卷王之王”,阿里确实当之无愧。
在它的“卷王之路”之路上,有一个非常重要的节点,就是今年 6 月初发布的 Qwen2 系列。
当时在发布会上给出的信息是:和上一个版本相比,通义千问 2 的理解能力、逻辑推理、指令遵循、代码能力分别提升了 9%、16%、19%、10%,中文能力更是持续领先业界。
特别是在我们更为熟悉的中文语境下,通义千问 2 版本的文本理解、文本生成、知识问答及生活常识等能力得到了显著增强。
同时 Qwen2-72B 也是拿出了一波非常亮眼的成绩,制造了一个又一个国产大模型在国际舞台上的高光时刻。
比如,最让人津津乐道的这个图片:
截图中的这个哥们叫做 Clem,是全球著名开源平台 huggingface 的联合创始人兼首席执行官,他今年 6 月就在社交平台公开宣布,阿里最新开源的 Qwen2-72B 指令微调版本,成为开源模型排行榜第一名。
他表示,为了提供全新的开源大模型排行榜,使用了 300 块 H100 对目前全球 100 多个主流开源大模型上进行了全新评估。
结果显示,阿里开源的 Qwen-2 72B 力压科技、社交巨头 Meta 的 Llama-3、法国著名大模型平台 Mistralai 的 Mixtral 成为新的王者。
这样的高光时刻还有很多。
回想起去年国内“百模大战”的时候,虽然各大厂商竞争到白热化程度,看起来一片生机勃勃的样子,但是我始终固执的认为在大模型领域,和国际上其他的大模型,比如炙手可热的 ChatGPT 是差了无数个身位的。
一年过去了,通义千问不仅仅是从国内的“百模大战”中厮杀出来了,而且还能在国际上去和排名靠前的选手们掰掰手腕了。
从国内的战场称王之后,逐渐步入了全球大模型竞争的核心腹地,在权威榜单多次创造中国大模型的“首次”。
同时通义千问也走出了国门,在国际舞台上抛头露面了。
比如在谷歌发布的最新开源模型 Gemma 2 的论文的技术报告部分,比较了不同开源 LLM 在之前 LLM 排行榜基准上的性能,Qwen1.5 系列模型作为中国唯一代表被拿来比较。
然是“背景板”,但是这个背景板也是对于实力的另外一种认可。
多模态,全尺寸
从这次大会的内容来看,通义千问的卷,不仅体现在国内外的各种榜单上,在“模态和尺寸”方面也是卷王一般的存在。
它涉及到的模态很多,参数覆盖面很广,用官方的说法叫做“多模态,全尺寸”,啥意思呢?
直接给你上个图:
在模态方面,大语言模型,它们能够理解和生成自然语言文本,就不多说了,这是看家本领。
还有视觉语言模型则能够处理图像信息并与文本关联,如进行图像描述或视觉问答。
代码模型擅长理解和生成编程代码,可以辅助程序员进行代码编写和优化,歪师傅的最爱。
音频语言模型则是处理语音信号的专家,可以实现语音识别与合成等任务。
数学模型则具备了解决数学问题的能力,可以用来解答各类数学题目。
在尺寸选择方面,从小型的模型参数规模在 0.5B 到 3B 之间,这类轻量级模型非常适合集成到耳机、智能手机等便携式设备中,以满足有限资源环境下的应用需求。
大到 32B-57B,开发者最喜欢的“黄金尺寸”,可以用到机器人、车载设备的场景,在性能和功耗之间获得最佳平衡,这个尺寸,就是性价比之王。
如果说你要做科研,追求更强大的模型以支持复杂的研究任务,还有 72B+ 开源旗舰版本可以选择。这类超大规模模型提供了更为强大的计算能力和更高的精度,适合用于前沿科学研究和技术开发。
而值得强调的是:这些都是开源的。
阿里可以说一直以来都非常重视开源生态的建设,并且在这方面做出了不少的贡献。
比如,一些在阿里内部用得很好的工具和技术框架,像中间件、数据库、大数据处理工具等,都开源出来,让全世界的开发者都能用上。通过共享代码和技术,开创者和使用者可以一起创造出更棒的东西。
此外,阿里还开放了一些数据集,特别是那些对研究机器学习、自然语言处理等领域有用的资料,帮助到有这方面需求的程序员们。
再比如每一年的云栖大会,也是秉着开源的精神,逐步变成了一个开发者的盛会,让更多的开发者能够聚集在一起,分享经验、解决问题、相互学习、共同进步。
通义千问当然也是开源的,甚至说通义 Qwen 系列是最强、最卷的开源大模型,在全球领先的开源大模型社区 HuggingFace 上广受好评,获得大量开发者点赞。
在这次云栖大会上,阿里也再次表达了对于开源的态度:通义不仅坚持开源开放,还要将开源开放生态做到极致,完成走向开发者和企业的最后一步。给开发者提供尽可能全面的帮助,共同构建最繁荣的开源社区。
本次一经发布,也再次引起了网友广泛的讨论:
当然,跑个分,打个榜什么的也是不在话下,再次迎来闪光时刻:
一不小心,上演了一出“自己打败自己”的戏码。
此外,我还看到这样一组很新的统计数据:
在 Huggingface 上,Qwen2 的原生和衍生模型超过五万个,排名全球第二,是仅次于 Llama 的世界级模型群。
这说明它的生态是非常好,活跃度极其高的。这数据已经不是一般的好了,实属“变态”级别的好。
生态好,选择多,一起玩得人也多,这是作为开发者最喜欢看到的场景。
最后,说了这么多,我强烈建议你自己上手体验一波。
歪师傅给你指个路,你玩儿去吧:
https://modelscope.cn/studios/qwen/Qwen2.5
你也别问它要什么,问就是:我全都要。
前两天,我还看到这样一个图片:
这是 2024 年 9 月 12 日,法国明星 AI 初创 Mistral AI 发布首个多模态模型 Pixtral 12B 时展示的资料。 资料显示,该模型在性能评测中与 Qwen2-7B、LLaVA-OV 7B、Phi-3 Vision 等模型做比较。Qwen 系列模型是国际顶流模型公司发布新模型时唯一会拿来进行对比的中国大模型。
结合前面谷歌的 Gemma 2 论文来看,Qwen 系列模型已经成为了模型公司在发布新产品时重要的参照标准之一。
作为通义千问的一名重度用户,看到这个消息的时候,再结合从国产大模型一路厮杀而出的背景,有一种欣慰的感觉,就是一种“孩子出息了”的发自内心的感叹。
不容易啊,真是不容易。