大模型争霸赛,清华ChatGLM进前5丨ChatGPT&AI 最近信息汇总13
注:体验AI新工具,请直接点击文末阅读原文
本周大新闻:万万没想到,现在大语言模型们也要像王者荣耀/LoL/Dota这些游戏里的玩家一样打排位赛了!据说,那些闭源模型们很快也会被拉出来溜溜。
热门内容
1
2.UC伯克利发布大语言模型排行榜!Vicuna夺冠,清华ChatGLM进前5
新品发现
2
1.影眸科技与上海科技大学共研一种文本指导的渐进式3D生成框架,5分钟生成漫威3D数字人!美队蜘蛛侠小丑都能搞定,高清还原面部细节
国内资讯
3
国际资讯
4
1.Stability AI连扔两个王炸!首个开源RLHF模型登基,DeepFloyd IF像素级出图
我和团队持续在关注ChatGPT ,我们会每周统计最近七天左右的信息, 方便大家了解, 也欢迎大家和我们一起交流。
另外,为深入探讨 AI 发展和其机遇,我们联络了相关老师共同创办了知识星球『AI商业观察』,加入者可获 AI最新发展情报、资源 以及 无需翻墙的AI链接 ,还有详细的指导教程哦~
名额有限,对此感兴趣的你,欢迎进来抢先学习和体验!
热门内容
1.GPT-4 可以免费使用了,额度有限!
近期,国外已经有不少产品开始接入 GPT-4,大部分都提供了免费试用权限,但额度有限。
下面就跟大家盘点一下,具体都有哪些方式,可以免费试用 GPT-4。
这些方案各有利弊,大家可自行斟酌使用。
① Vercel Playground
前不久,Vercel 也推出了一个 AI Playground 产品,支持用户在上面评测多款 AI 大语言模型,其中自然也包含 GPT-4。
地址:https://play.vercel.ai/
② Quora 旗下产品:Poe
目前已上线 App Store,但需要美区账号才能下载。
该产品内置了多款主流的大语言模型,其中包括 GPT-4,以及前 OpenAI 成员开发的 Claude。
地址:https://poe.com/
③ ForeFront
该工具支持跟预设角色对话,在线生成图片,分享聊天内容等功能,使用 Google 授权即可登录。
地址:https://chat.forefront.ai/
2.UC伯克利发布大语言模型排行榜!Vicuna夺冠,清华ChatGLM进前5
万万没想到,现在大语言模型们也要像王者荣耀/LoL/Dota这些游戏里的玩家一样打排位赛了!
最近,来自LMSYS Org(UC伯克利主导)的研究人员又搞了个大新闻——大语言模型版排位赛!
顾名思义,「LLM排位赛」就是让一群大语言模型随机进行battle,并根据它们的Elo得分进行排名。
然后,我们就能一眼看出,某个聊天机器人到底是「嘴强王者」还是「最强王者」。
划重点:团队还计划把国内和国外的这些「闭源」模型都搞进来,是骡子是马溜溜就知道了!(GPT-3.5现在就已经在匿名竞技场里了)
匿名聊天机器人竞技场长下面这样:
很明显,模型B回答正确,拿下这局;而模型A连题都没读懂……
项目地址:https://arena.lmsys.org/
在当前的排行榜中,130亿参数的Vicuna以1169分稳居第一,同样130亿参数的Koala位列第二,LAION的Open Assistant排在第三。
清华提出的ChatGLM,虽然只有60亿参数,但依然冲进了前五,只比130亿参数的Alpaca落后了23分。
相比之下,Meta原版的LLaMa只排到了第八(倒数第二),而Stability AI的StableLM则获得了唯一的800+分,排名倒数第一。
团队表示,之后不仅会定期更新排位赛榜单,而且还会优化算法和机制,并根据不同的任务类型提供更加细化的排名。
目前,所有的评估代码以及数据分析均已公布。
3.德克萨斯大学开发了一种类ChatGPT模型解码大脑信息,准确率高达82%
来自德克萨斯大学奥斯汀分校的研究者开发了一种基于GPT的语言解码器。
它能通过非侵入性的MRI/fMRI收集大脑活动信息,并将思维转化为语言文字。
论文地址:
https://www.nature.com/articles/s41593-023-01304-9
令人震惊的是,当你在看皮克斯无声电影时,大脑解码器都能读出你的想法。
这个类ChatGPT模型,以前所未有的准确率解码人类思想,不仅开启了大脑成像的新潜力,并引发了人们对隐私的担忧。
研究一出,在网上掀起了轩然大波。网友惊呼,太恐怖了。
4. AI在劳动节淘汰7800打工人,永久的
就在这个劳动节假期,科技巨头IBM宣布:
暂缓可以被AI取代的岗位的招聘,约7800人将被永久淘汰。
尽管“我们要被AI取代”的唬人消息不是第一次出现了,但正如外媒Ars Technica所说:
IBM直接将这个问题“摆到了台面上”。
换而言之,IBM打响了科技巨头用AI取代人类岗位的第一枪。
5.75岁图灵奖得主Hinton离职谷歌:痛悔毕生工作,无法阻止人类AI大战
深度学习泰斗、神经网络之父Geoffrey Hinton突然宣布离职谷歌。
为了能够自由谈论人工智能风险,而不考虑这对谷歌的影响。
纽约时报的报道中,Hinton直接警示世人:注意,前方有危险,前方有危险,前方有危险!
而正是对人工智能风险深深地担忧,让这位深度学习巨佬直言:「我对自己的毕生工作,感到非常后悔。」
如今,距离Hinton入职谷歌,刚好十年。
对于Hinton此举,有人甚至劝说,应该将关注人工智能安全常态化,而不必辞去工作。
这更应该是你留下来的理由。因为世界是不会停止的,像你这样的伟大人物应该坚持下去,并将人工智能发展得更好。
你应该劝说你的学生Yann LeCun和Ilya Sutskever。
值得一提的是,ChatGPT背后真正的英雄正是OpenAI的联合创始人兼首席科学家Ilya。
、
新品发现
1.影眸科技与上海科技大学共研一种文本指导的渐进式3D生成框架,5分钟生成漫威3D数字人!美队蜘蛛侠小丑都能搞定,高清还原面部细节
近期,Google、NVIDIA和微软等公司推出了基于神经辐射场(NeRF)的3D生成方法,但这些方法与传统的3D渲染软件(如Unity、Unreal Engine和Maya等)存在兼容性问题,限制了其在实际应用中的广泛应用。
为此,影眸科技与上海科技大学的研发团队提出了一种文本指导的渐进式3D生成框架,旨在解决这些问题。
该研究团队提出的文本指导的渐进式3D生成框架(简称DreamFace),结合了视觉-语言模型、隐式扩散模型和基于物理的材质扩散技术,生成符合计算机图形制作标准的3D资产。
这一框架的创新之处在于其几何体生成、基于物理的材质扩散生成和动画能力生成三个模块。
这项工作已被顶级期刊Transactions on Graphics接收,并将在国际计算机图形学顶级会议SIGGRAPH 2023上展示。
项目网站:
https://sites.google.com/view/dreamface
预印版论文:https://arxiv.org/abs/2304.03117
Web Demo: https://hyperhuman.top
HuggingFace Space:https://huggingface.co/spaces/DEEMOSTECH/ChatAvatar
2.能说会唱,AudioGPT惊艳亮相!浙大、北大、CMU等提出全新音频理解与生成系统
近日,来自浙大、北大、CMU和人大的研究人员提出了一种全新的音频理解与生成系统AudioGPT。
不仅能够实现跨模态转换,以及音频模态的理解、生成,还能够解决20+种多语种、多模态的AI音频任务。
论文地址:
https://arxiv.org/pdf/2304.12995.pdf
Github:
https://github.com/AIGC-Audio/AudioGPTHuggingg Face:
https://huggingface.co/spaces/AIGC-Audio/AudioGPT
国内资讯
1.智谱AI CEO张鹏:ChatGLM全球超过百万下载,为行业智能化降本增效
具体介绍几个产品。
在座有没有程序员?
程序员非常喜欢这样的工具(CodeGeeX),提升大家的工作效率,而且这个工具是免费的,所以大家尽管去试,尽管去用。
其次,文字工作者们也可以用这样的辅助写作工具(写作蛙),完成营销文案、社交媒体内容,或者做细分场景划分,比如可以用他来写一封给我孩子的信,让他带到学校去,在老师同学们面前念出来,我觉得写得比我自己写得好。
在聊天的场景下(小呆)我们也可以让它去扮演某一种角色每天跟你聊一会儿,安慰你的心灵,或者你喜欢一个可爱的女朋友,你可以设定一下跟你聊一聊。
商业落地方面,如美团电商平台,用我们大模型提升广告推广以及提高客户服务场景下的任务的性能;世界杯期间我们也服务了特殊的人群——听障人士,用手语方式现场实时直播,关爱听障人士。
未来,大模型能帮大家做很多事情,包括工作、生活甚至创新范式,大模型的快速进步给实现通用人工智能(AGI)带来了曙光。让我们一起多一些期待,多一点耐心,一起拥抱这个伟大的AI时代,谢谢大家。
2.米哈游发布首个AIGC工具
米哈游自研的 AIGC H5工具活动“无尽的三月七”已经上线,用户可以把上传的图片都变成《崩坏:星穹铁道》的看板娘三月七。
截至目前,活动在全网收获了玩家们的广泛反响和参与,米哈游官方发出了米哈游总裁大伟哥“三月七化”的示意图,相关话题也多次登上多个平台热搜。
国际资讯
1.Stability AI连扔两个王炸!首个开源RLHF模型登基,DeepFloyd IF像素级出图
最近,大名鼎鼎的Stable Diffusion背后的公司,一连整了两个大活。
首先,Stability AI重磅发布了世上首个基于RLHF的开源LLM聊天机器人——StableVicuna。
StableVicuna基于Vicuna-13B模型实现,是第一个使用人类反馈训练的大规模开源聊天机器人。
有网友经过实测后表示,StableVicuna就是目前当之无愧的13B LLM之王!
对此,1x exited创始人表示,这可以看作是自ChatGPT推出以来的第二个里程碑。
另外,Stability AI 发布了开源模型DeepFloyd IF,这个文本到图像的级联像素扩散模型功能超强,可以巧妙地把文本集成到图像中。
这个模型的革命性意义在于,它一连解决了文生图领域的两大难题:正确生成文字,正确理解空间关系!秉持着开源的一贯传统,DeepFloyd IF在以后会完全开源。
Stailibity AI,果然是开源界当之无愧的扛把子。
2.斯坦福最新研究警告:别太迷信大模型涌现能力,那是度量选择的结果
大模型出现后,涌现这一术语开始流行起来,通常表述为在小规模模型中不存在,但在大规模模型中存在的能力。但斯坦福大学的研究者对 LLM 拥有涌现能力的说法提出了质疑,他们认为是人为选择度量方式的结果。
大模型领域的「涌现」如何定义?一种通俗的说法是「在小规模模型中不存在,但在大规模模型中存在的能力」,因此,它们不能通过简单地推断小规模模型的性能改进来预测。
这种涌现的能力可能首先在 GPT-3 家族中被发现。后续的一些工作强调了这一发现:「虽然模型性能在一般水平上是可以预测的,但在特定任务上,其性能有时会在规模上出现相当难以预测的涌现」。
事实上,这些涌现能力非常令人惊讶,以至于「突然的、特定的能力扩展」已经被认为是 LLM 的两个最高定义特征之一。此外,「breakthrough capabilities」和「sharp left turns」等术语也被使用。
综上所述,我们可以确定 LLM 涌现能力的两个决定性属性:
1. 敏锐性,从「不存在」到「存在」似乎只是瞬间的过渡;
2. 不可预测性,在看似不可预见的模型规模内过渡。
与此同时,还有一些问题悬而未决:是什么控制了哪些能力会涌现?什么控制着能力的涌现?我们怎样才能使理想的能力更快地涌现,并确保不理想的能力永不涌现?
这些问题与人工智能的安全和对齐息息相关,因为涌现的能力预示着更大的模型可能有一天会在没有警告的情况下获得对危险能力的掌握,这是人类不希望发生的。
在最新的一篇论文中,斯坦福大学的研究者对 LLM 拥有涌现能力的说法提出了质疑。
论文:https://arxiv.org/pdf/2304.15004.pdf
3.用ChatGPT直播带货!Firework发布全球首个直播购物GPT
美东时间5月3日,美通社消息,视频技术服务平台Firework,宣布推出首个用于视频直播服务的类ChatGPT生成式AI产品,以帮助播主提升商业化转化率和客户体验。
据悉,美国著名连锁超市The Fresh Market将成为该产品的首批用户,将其用于视频直播、网络销售等。
互动性是直播带货的精髓之一。但传统直播带货结束后,用户想询问任何有关商品、直播的问题,例如,视频中制作的沙拉配方是什么?只能求助人工客服才能完成。
现在,通过将生成式AI功能集成在直播服务中,即便视频结束也能帮助用户解答任何有关视频的问题。
也就是说通过类ChatGPT功能,可以将直播带货的互动性永远保持下去,这对于拉升销售额、客户体验有着巨大帮助。
此外,头部直播带货主播的一场用户观看量在几万甚至十几万,根本无法为每一位用户解答商品询问从而错过购买机会。
而类ChatGPT功能相当于为每一位观众配备了“智能秘书”,帮助他们回答任何与商品、播主有关的问题,不会让用户因为无法得到有效答案而离开直播间。
—The end—
声明:以上仅做个人分享,不构成投资建议。