土匪投资日记

百度正式推出“文心一言”,港股盘中跌超10%!丨ChatGPT&AI 最近信息汇总6

注:体验AI新工具,请直接点击文末阅读原文

本周大新闻:3月16日下午两点,百度正式推出“文心一言” ,期间港股盘中跌超10%,之后有所回弹。目前内测文心一言需要邀请码,企业用户可以排队申请。

发布会多少让人有些失望,但尚在预期,还是期待他像 OpenAI 一样青云直上。毕竟,目前看,如果国内百度做不好大模型,可能其他公司也够呛。

Image

热门资讯

1

1.文心一言 vs GPT-4实测!百度背水一战交卷

2.OpenAI发布GPT-4:能识图能算税,ChatGPT摆脱Chat,再次进化

3.LeCun狂赞:600刀GPT-3.5平替!斯坦福70亿参数「羊驼」爆火,LLaMA杀疯了

4.揭秘ChatGPT背后天价超算!上万颗英伟达A100,烧光微软数亿美元

5.微软再扔AI聊天画图炸弹!视觉模型加持ChatGPT,Visual ChatGPT横空出世

行业要闻

2

1.GPT“攻陷”画师、写手等行业,接下来这一重要领域也危险了!

2.ChatGPT火出圈!人工智能工程师平均招聘月薪突破2.5万

公司动态

3

1.谷歌的又一波反击!开放大语言模型PaLM API,让AI帮你打工

2.清华朱军团队开源首个基于Transformer的多模态扩散大模型,文图互生、改写全拿下

3.重磅,ChatGPT要上车了!微软联手通用,百度后天出招

观点荟萃

4

1.ChatGPT大升级,留给人类的时间不多了

2.ChatGPT写着色器、Stable Diffusion生成风格动画,AI影视级动捕,Nuke GPT来袭·····

我和团队持续在关注ChatGPT和文心一言 ,我们会每周统计最近七天左右的信息, 方便大家了解, 也欢迎大家和我们一起交流文心一言相关信息哦~

另外,为深入探讨 AI 发展和其机遇,我们联络了相关老师共同创办了知识星球『AI商业观察』,加入者可免费获赠 18美元的chatgpt账号 一个和价值169元的国内版 一个,还有详细的指导教程。

Image

名额有限,对此感兴趣的你,欢迎进来抢先学习和体验!

Image

热门资讯

1.文心一言 vs GPT-4实测!百度背水一战交卷

百度于3月16日14时在北京总部召开新闻发布会,主题围绕文心一言。

百度CEO李彦宏宣布正式推出大语言模型生成式AI产品“文心一言”。

Image

李彦宏展示了文心一言在文学创作、商业文案创作、数理推算、中文理解、多模态生成五个使用场景中的综合能力。

Image

我大概汇总了一下发布会中关于文心一言的相关信息:

1、文心一言可以回答一些基础问题,也可以进行数理逻辑推算。但在视频中,没有看到文心一言回答追问的能力。而回答追问的能力显然更重要。

2、可以处理英文,但不得不承认它的英语能力不如中文。

3、支持多模态生成,包括文本、图片、音频、视频。音频部分,还结合中国特色,有方言的能力。

4、可以基于命令,生成文案。但是否可以进一步基于指令优化文案,未知。

5、百度认为,大模型时代,创业者在应用开发方向大有可为。比如文字、图像、音视频生成、数字人、3D 生成等。

6、百度基本具备大模型的技术能力,但目前训练还不充分,所以产品还不是那么完美。需要大家给点时间。

7、3月16日起,首批用户即可通过邀请测试码,在文心一言官网体验产品,后续将陆续开放给更多用户。

文心一言:https://yiyan.baidu.com/

百度云文心一言内测申请链接,只开放给企业用户:

https://cloud.baidu.com/survey_summit/wenxin.html?track=C896034

百度盘中股价跌幅一度扩大超10%,报120.1港元,截至发稿,百度港股股价在一波明显下跌之后,有所回弹。

Image

发布会结束,网友反应最多的是“提前录制有点败好感”:

Image
Image

也有人调侃,看完之后感觉“提前退休的日子看起来还可以缓一缓”:

Image

2.OpenAI发布GPT-4:能识图能算税,ChatGPT摆脱Chat,再次进化

离发布仅仅四个多月,在ChatGPT展现了惊人的实力之后,OpenAI又扔下了一颗核弹:GPT-4发布了。

在博文中,OpenAI写到:

我们创建了GPT-4,这是 OpenAI 努力扩展深度学习的最新里程碑。GPT-4 是一个大型多模态模型(接受图像和文本输入,提供文本输出),虽然在许多现实世界场景中的能力不如人类,但在各种专业和学术基准上表现出人类水平。

放心,这是OpenAI谦虚了。

GPT再一次进化,总结文章、写代码、报税、写诗…… GPT-4轻松拿下GPT-3.5做不到的系列事情。还可以解析图像。

Image

不得不提的是,尽管功能强大,但 GPT-4 与早期的 GPT 模型具有相似的局限性——它仍然会大胆自信地编造事实,并且会出现推理错误。OpenAI强调,仍然推荐在使用它的时候要附加诸如人工审查、或者附加上下文,甚至在高风险情境中,要避免使用它。

目前有两种办法可以体验GPT-4。

如果你是普通用户,此前订阅了ChatGPT Plus,将会直接获得GPT-4的访问权限。不过,ChatGPT Plus只能用美国信用卡开通。

如果你是开发者,要访问GPT-4 API(使用与GPT-3.5-turbo相同的ChatCompletions API),需要像等待New Bing一样加入OpenAI的候补名单。

3.LeCun狂赞:600刀GPT-3.5平替!斯坦福70亿参数「羊驼」爆火,LLaMA杀疯了

Meta的LLaMA模型开源,让文本大模型迎来了Stable Diffustion时刻。今天,斯坦福发布了一个由LLaMA 7B微调的模型Alpaca(草泥马),训练3小时,性能比肩GPT-3.5。

Image

Alpaca是由Meta的LLaMA 7B微调而来的全新模型,仅用了52k数据,性能约等于GPT-3.5。

关键是训练成本奇低,不到600美元。具体花费如下:

在8个80GB A100上训练了3个小时,不到100美元;

生成数据使用OpenAI的API,500美元。

Image

斯坦福大学计算机科学副教授Percy Liang称,

由于缺乏透明度/无法完全访问像GPT 3.5这样的有能力的指令模型,进而限制了这一重要领域的学术研究。我们在 Alpaca (LLaMA 7B + text-davinci-003)上迈出了一小步。

4.揭秘ChatGPT背后天价超算!上万颗英伟达A100,烧光微软数亿美元

ChatGPT能成为如今火遍全球的顶流模型,少不了背后超强的算力。数据显示,ChatGPT的总算力消耗约为3640PF-days(即假如每秒计算一千万亿次,需要计算3640天)。

那么,作为依托的那台微软专为OpenAI打造的超级计算机,又是如何诞生的呢?周一,微软在官博上连发两文,亲自解密这台超级昂贵的超级计算机,以及Azure的重磅升级——加入成千上万张英伟达最强的H100显卡以及更快的InfiniBand网络互连技术。

Image

基于此,微软也官宣了最新的ND H100 v5虚拟机,具体规格如下:

8个NVIDIA H100 Tensor Core GPU通过下一代NVSwitch和NVLink 4.0互联

每个GPU有400 Gb/s的NVIDIA Quantum-2 CX7 InfiniBand,每个虚拟机有3.2Tb/s的无阻塞胖树型网络

NVSwitch和NVLink 4.0在每个虚拟机的8个本地GPU之间具有3.6TB/s的双向带宽

第四代英特尔至强可扩展处理器

PCIE Gen5到GPU互连,每个GPU有64GB/s带宽

16通道4800MHz DDR5 DIMM

这是数亿美元撑起来的算力。

5.微软再扔AI聊天画图炸弹!视觉模型加持ChatGPT,Visual ChatGPT横空出世

近日,微软亚研院发布了一个炸弹级模型Visual ChatGPT。

Image

论文地址:https://arxiv.org/abs/2303.04671

注入视觉模型后,ChatGPT直接化身艺术大师,想要什么作品,动动嘴就行了。-帮我画一个苹果。Visual ChatGPT直接生成了一张画好的图。

Image

这还仅是前菜,Visual ChatGPT各种画风全能hold住,比如:随便给个草图框架,它便能输出一幅精美的画作。

Image

另外,上色、「抠图」、深度图、基于深度图再生成图片都能拿捏。一张简陋的图经过你的精心调教后,就变成了这个样子。

Image

当然了,Visual ChatGPT没有忘本,让它进行创作的同时,还能描述图片、回答问题。

Image

有了Visual ChatGPT的加持,微软必应简直可以制霸全世界了。

行业要闻

1.GPT“攻陷”画师、写手等行业,接下来这一重要领域也危险了!

随着 ChatGPT 被越来越多的开发者应用,现在它还能用于音乐、绘画、乃至医学研究等不同领域。当然,除了这些,游戏也是开发者们重点关注的一大领域。

近日,来自哥本哈根信息技术大学(IT University of Copenhagen)的研究者发表了一项新的研究成果,为 ChatGPT 模型在程序化内容生成(Procedural Content Generation,PCG)领域开辟了一个新的方向——利用大型语言模型,将自然语言的描述文字转换成实际可玩的“超级马力欧兄弟(Super Mario Bros.)”游戏关卡。

无独有偶,几乎在同一天,纽约大学坦登工程学院(NYU Tandon School of Engineering)的研究人员为了验证此类语言模型在生成非语言类作品方面的潜力,也发布了一篇利用大型语言模型自动生成”推箱子“游戏关卡的论文。

2.ChatGPT火出圈!人工智能工程师平均招聘月薪突破2.5万

今年以来随着ChatGPT聊天程序火爆出圈,人工智能技术已经越来越受到企业的重视,这让“人工智能”相关专业的求职者备受青睐。

在北京的一场春季校园招聘会上,记者了解到,人工智能相关专业的毕业生在今年的就业市场上,成了不少企业争抢的“香饽饽”。同时,“人工智能工程师”一直位列高薪职业排行“头部”,岗位的平均招聘月薪近期也一度突破了25000元。

Image
Image

公司动态

1.谷歌的又一波反击!开放大语言模型PaLM API,让AI帮你打工

谷歌于3月15日开放了自家的大语言模型 API 「PaLM API」,此外今天谷歌还发布了一款帮助开发者快速构建 AI 程序的工具 MakerSuite。谷歌表示,此举是为了帮助开发者们快速构建生成式 AI 应用。

Image

但略为遗憾的是,谷歌目前是向选定的开发人员提供这些工具,而非全面开放。

2.清华朱军团队开源首个基于Transformer的多模态扩散大模型,文图互生、改写全拿下

清华大学计算机系朱军教授带领的 TSAIL 团队近期公开的一篇论文《One Transformer Fits All Distributions in Multi-Modal Diffusion at Scale》,率先发布了对多模态生成式模型的一些探索工作,实现了任意模态之间的相互转化。

Image

论文链接:

https://ml.cs.tsinghua.edu.cn/diffusion/unidiffuser.pdf

开源代码:https://github.com/thu-ml/unidiffuser

该论文提出了一个为多模态设计的概率建模框架 UniDiffuser,并采用该团队提出的基于 transformer 的网络架构 U-ViT,在开源的大规模图文数据集 LAION-5B 上训练了一个十亿参数量的模型,使得一个底层模型能够高质量地完成多种生成任务(图 1)。简单来讲,除了单向的文生图,还能实现图生文、图文联合生成、无条件图文生成、图文改写等多种功能,大幅提升文图内容的生产效率,也进一步提升了生成式模型的应用想象力。

3.重磅,ChatGPT要上车了!微软联手通用,百度后天出招

日前,外媒Teslarati报道称通用汽车正在与微软进行合作研究,有望在未来汽车中引入ChatGPT。

通用汽车副总裁Scott Miller表示,ChatGPT将无处不在,人工智能聊天机器人可以变革人们在日常生活中与技术的互动方式,包括在驾驶汽车时。目前,通用汽车正在探索如何在未来的车辆中使用这项技术。至此,通用汽车几乎是国外第一家正式宣布引入ChatGPT的车企。

无独有偶,早在2月中下旬,ChatGPT热席卷全球之际,国内诸多车企业早已看准时机,纷纷宣布与百度推出的生成式对话产品文心一言开展合作,而文心一言也被称为“中国版ChatGPT”。

知识荟萃/研究成果

近日,OpenAI召开了一场线上发布会,公布了全新的人工智能模型GPT-4。

GPT-4的重大提升是他变成了一个多模态模型。简单来说,GPT-3只认字,但是GPT-4能听声音,还能看懂图片、视频了。

AI时代已经滚滚而来了。从我们一本正经地讨论“AI会不会取代人类”到失业,可能只有一场发布会的距离。

Image

图源:微博用户@创作者DC

《人类简史》中曾经提出过观点,说农业革命是史上最大的骗局。

人类自以为驯化了植物,实际上是植物驯化了人类——农民想尽办法培育、花大量时间和劳动力浇灌,做人的身体本不擅长的农业劳作,累出一身病,研究发现人类到农业时代后出现了大量疾病,例如椎间盘突出和关节炎,比采集时代辛苦得多。可最终,却是帮助植物一代代繁衍,并占领越来越多的土地。

一万多年前的小麦和水稻如此,今天的AI也是如此。

如果按照这个逻辑推论,那也许就像刘慈欣指出的:AI对人类的控制,现在就已经悄悄开始了。

2.ChatGPT写着色器、Stable Diffusion生成风格动画,AI影视级动捕,Nuke GPT来袭·····

最近有个国外的艺术家写了一个脚本把ChatGPT植入到了Nuke里,能干啥?

它可以帮助你写Python,TCL,Nuke表达式和BlinkScript。可直接在Nuke中使用OpenAI的模型生成代码,轻松地将其集成到Nuke工作流程中,只需单击几下即可生成Python脚本。

—The end—

声明:资料来源于网络,图文如有侵权请联系删除。