土匪投资日记

人类能躺平养老了吗?在被AI全面包围后?丨ChatGPT&AI 最近信息汇总10

注:体验AI新工具,请直接点击文末阅读原文

本周大新闻:人类能躺平养老了吗?假如被AI全面轰炸碾压后?本周AI圈”最红炸子鸡“诞生——AutoGPT。不仅如此,这款软件系统的横空出世,一举将AI进程推向了新高度——自主人工智能,即完全不用人类插手的那种!

热门资讯

1

1.本周最火AutoGPT!GitHub3.6万+标星,解决复杂任务全程无需人类插手

2.炸翻AI和生化环材圈!GPT-4学会自己搞科研,手把手教人类做实验

3.GPT-5年底上线?初创公司Runway CEO再爆料:OpenAI员工相信GPT-5有望成AGI(通用人工智能)

4.终结扩散模型:OpenAI开源新模型代码,一步成图,1秒18张

5.微软开源DeepSpeed Chat,人人可快速训练百亿、千亿级ChatGPT大模型

行业要闻

2

1.爆火AIGC产品卷翻海外营销:AI一键搞定美工和拍摄,抠图PS设计样样精通,月活迅速破百万

2.AI大事件!权威发声:全行业谨慎使用ChatGPT!

公司动态

3

1.风格强化、极致动漫美学,绘画神器Midjourney迎来二次元升级

2.呼吁暂停 GPT-5 研发的马斯克,转身抢购 1 万个 GPU,为 Twitter 大模型做准备!

研究成果

4

1.Google Bard 大更新!我们用 GPT-4 给它出了 20 道题

2.大模型时代,商汤造“工厂”

3.重磅!阿里巴巴所有产品未来将接入大模型全面升级

我和团队持续在关注ChatGPT ,我们会每周统计最近七天左右的信息, 方便大家了解, 也欢迎大家和我们一起交流。

另外,为深入探讨 AI 发展和其机遇,我们联络了相关老师共同创办了知识星球『AI商业观察』,加入者可获 AI最新发展情报、资源 以及 无需翻墙的AI链接 ,还有详细的指导教程哦~

名额有限,对此感兴趣的你,欢迎进来抢先学习和体验!

Image

热门资讯

1.本周最火AutoGPT!GitHub3.6万+标星,解决复杂任务全程无需人类插手

本周AI圈”最红炸子鸡“诞生——AutoGPT。不仅如此,这款软件系统的横空出世,一举将AI进程推向了新高度——

自主人工智能。

顾名思义,它所具备的能力主打的就是一个“自主”,完全不用人类插手的那种!

例如一位网友就要求AutoGPT开发一个网站,结果不到3分钟,AI自己就用React和Tailwind CSS“唰唰唰”地搞定了。

Image

AI自己上网、自己使用第三方工具、自己思考、自己操作你的电脑。

这一套打法,算得上是把“行动→观察结果→思考→决定下一步行动”这条路子给打通并循环了起来。

就连前特斯拉AI总监Andrej Karpathy对此都评价道:

AutoGPT是提示工程的下一个前沿。

Image

而且不只是AutoGPT,最近还陆陆续续地衍生出了各种自主人工智能工具,例如AgentGPT、BabyAGI等等。

然后网友们面对此景也坐不住了,惊叹于AI发展的日新月异:

Image

2.炸翻AI和生化环材圈!GPT-4学会自己搞科研,手把手教人类做实验

GPT-4等大模型组成的AI智能体,已经可以手把手教你做化学实验了,选啥试剂、剂量多少、推理反应会如何发生,它都一清二楚。颤抖吧,生化环材圈!

最近,卡耐基梅隆大学的几位科学家发表了一篇论文,同时炸翻了AI圈和化学圈。

他们做出了一个会自己做实验、自己搞科研的AI。这个AI由几个大语言模型组成,可以看作一个GPT-4代理智能体,科研能力爆表。

Image

因为它具有来自矢量数据库的长期记忆,可以阅读、理解复杂的科学文档,并在基于云的机器人实验室中进行化学研究。

网友震惊到失语:所以,这个是AI自己研究然后自己发表?天啊。

Image

还有人感慨道,「文生实验」(TTE)的时代要来了!

Image

3.GPT-5年底上线?初创公司Runway CEO再爆料:OpenAI员工相信GPT-5有望成AGI(通用人工智能)

最近,又有网友翻出了关于GPT-5的爆料。

据a16z资助的初创公司Runway CEO兼AI投资人Siqi Chen表示,预计到2023年底,GPT-4将被新的GPT-5版本取代。

Image

有人告诉我,GPT-5计划于今年12月完成培训,并且OpenAI期望它实现AGI。它是否能实现AGI?毫无疑问,会发生一场激烈的讨论。

它会。

另外,Siqi Chen还透露,有部分OpenAI员工期望,GPT-5能与人类的能力对齐。

在和网友的辩论中,Siqi Chen表示,达到AGI的GPT-5,或许已经不需要prompt了。

Image

他表示,GPT-5离AGI比人们所想的要近得多。

Image

另外他强调:我并不是说用GPT-5会实现AGI是OpenAI内部所有人的共识,但OpenAI中确实有人这样认为。

Image

4.终结扩散模型:OpenAI开源新模型代码,一步成图,1秒18张

在 AI 画图的领域,人们一直关注的是扩散模型,人们一直在尝试不断改进,推出了 Stable Diffusion、Midjourney、DALL-E 等技术,并在其基础上构建应用。不过最近,OpenAI 提出的全新生成模型看起来要让这一领域经历一场革命。

论文内容主要是关于图像生成领域的。作者阵容也非常强大,有本科毕业于清华大学数理基础科学班、目前在 OpenAI 担任研究员的宋飏。此外还包括 OpenAI 联合创始人、首席科学家 Ilya Sutskever。

前面我们已经提到,OpenAI 的这项研究主要是图像生成方面的,大家或多或少地都听过这项技术,例如最近热门的 Midjourney 和 Stable Diffusion,它们大都采用扩散模型,由于其生成的图片效果惊艳,很多人都将其视为最好的工具。但扩散模型依赖于迭代生成过程,这导致此类方法采样速度缓慢,进而限制了它们在实时应用中的潜力。

OpenAI 的这项研究就是为了克服这个限制,提出了 Consistency Models,这是一类新的生成模型,无需对抗训练即可快速获得高质量样本。与此同时,OpenAI 还发布了 Consistency Models 实现以及权重。

Image

论文地址:https://arxiv.org/pdf/2303.01469.pdf

代码地址:

https://github.com/openai/consistency_models

网友认为扩散模型的时代即将结束。

Image

更有网友测试了生成速度,3.5 秒生成了 64 张分辨率 256×256 的图片,平均一秒生成 18 张。

Image

5.微软开源DeepSpeed Chat,人人可快速训练百亿、千亿级ChatGPT大模型

4月12日,微软开源的 DeepSpeed Chat 引起了AI社区的广泛关注。它让我们能够以更低的成本、更快的速度训练类似于ChatGPT的高质量大模型。

链接:

https://github.com/microsoft/DeepSpeed/tree/master/blogs/deepspeed-chat

DeepSpeed-Chat 是更大的 DeepSpeed 生态系统的一部分,包括众多深度学习系统和建模技术。要了解更多信息,请访问我们的网站(https://www.deepspeed.ai/),了解详细的博客文章、教程和有用的文档。

你还可以关注我们的英文 Twitter(DeepSpeed) 和日文 Twitter(マイクロソフト DeepSpeed),了解 DeepSpeed 的最新动态。

行业要闻

1.爆火AIGC产品卷翻海外营销:AI一键搞定美工和拍摄,抠图PS设计样样精通,月活迅速破百万

就在最近,海外一款名为ZMO.AI的生成式营销软件,B端用户月活迅速突破百万,ARR达到300万美金。

Image

△官网地址:https://background.zmo.ai/

看来,老营销人也逃不过这一波AI的失业潮了。\

据悉,ZMO.AI旗下的AI背景生成生成, 只需商家上传一张产品图,便可以在100%保留产品细节的前提下,依据指令生成成千上万不同风格的背景。

其逼真度堪比大片的商用场景图,无论是光影还是清晰度,都完胜超过10年经验的PS大师。

它家的另一个产品Marketing Copilot,更是只需上传一张产品图,便可从拍摄、到海报制作、到后期投放优化全部嵌入AI workflow的自动化流程,利用AI强大的创造力和分析能力实现运营秒秒钟优化。

这么开箱即用的产品,让不懂拍摄和PS的小老板也能上手。

Image

△官网地址:https://background.zmo.ai/

2.AI大事件!权威发声:全行业谨慎使用ChatGPT!

ChatGPT的热度已经蔓延到支付领域,部分支付企业员工开始使用ChatGPT等工具开展工作。

一则倡议或将给这种热度“降降温”。中国支付清算协会4月10日发布的关于支付行业从业人员谨慎使用ChatGPT等工具的倡议显示,此类智能化工具已暴露出跨境数据泄露等风险。

Image

为有效应对风险、保护客户隐私、维护数据安全,中国支付清算协会向支付行业发出倡议:

一是提高思想认识,依法依规使用。支付行业从业人员要遵守所在地区的网络使用规定,正确认识ChatGPT等工具的机遇和风险,全面评估使用ChatGPT等工具处理工作内容的风险,依法合规使用ChatGPT等工具。

二是不上传关键敏感信息。支付行业从业人员在使用ChatGPT等工具时,要严格遵守国家及行业相关法律法规要求,不上传国家及金融行业涉密文件及数据、本公司非公开的材料及数据、客户资料、支付清算基础设施或系统的核心代码等。

三是会员单位加强内部管理和引导。会员单位要进一步健全信息安全内控管理制度,开展有针对性的数据风险防控工作,加强宣传和引导,提升员工的风险防范和数据保护意识,切实维护国家金融及支付清算行业安全。

公司动态


1.风格强化、极致动漫美学,绘画神器Midjourney迎来二次元升级

2022 年 3 月发布的 AI 绘画神器 Midjourney,由于「炸裂」的生成效果引发了人们的广泛关注。

近日 Midjourney 推出了 Niji-journey V5,它是一个针对二次元动漫的版本。Niji V5 支持了风格化(stylize)参数设置。

比如设计一些宫崎骏风格的、包含运动和柚子元素的插画。

Image

比如「皮克斯风格、名叫 Zhao Xiaowu 的男孩、背着运动背包高兴地去爬山、阳光明媚、popmart 风格、鲜花和绿草环绕、黏土材质、丰富细节、柔和边缘、OC 渲染、HD 细节」。

Image

再比如「黑泽明电影中的宇航员战士,使用 Okumura Togyu 动画插图风格的黑白粗粒胶片人物肖像。」

Image

新旧版本效果比较

与老版本 Niji 模型相比,Niji V5 有哪些不同呢?来看下面两组对比图(左为老版本 Niji 模型,右为 Niji V5)。

Image
Image

与 Niji V4(左)相比,Niji V5(右)有时更写实、看起来更像真人。

Image

修改风格化参数

下图左上为老版本 Niji 的成图效果,右上为 Niji V5(s 为 0)、左下为 Niji V5(s 为 100),右下为 Niji V5(s 为 1000)。

Image

不过,在生成一些人物图时,我们可以看到明显的出入和瑕疵。比如「安妮海瑟薇开心地在跑步、沐浴在阳光下、穿着灰色的合身运动衫、黑色的打底裤、粉色跑步袜、白色跑步鞋、纽约中央公园、写实和超精细渲染风格、超写实油画……」。

Image

2.呼吁暂停 GPT-5 研发的马斯克,转身抢购 1 万个 GPU,为 Twitter 大模型做准备!

据 BusinessInsider 最新报道,继招揽 Deepmind 大牛,拟另起炉灶组队开发 ChatGPT 替代品之后,马斯克豪掷千金购买了 10000 个 GPU,正在 Twitter 内部火热地搞起一个人工智能项目落地。

马斯克之所以在自己拥有的多家公司中选中 Twitter 来试点 AI 技术,是因为 Twitter 作为社交平台的属性,拥有海量的数据。

据悉,马斯克在 Twitter 的 AI 项目涉及一个大型语言模型,LLM 本质上是人工智能,它接受了大量数据的训练,因此它最终可以自己创建新的、看似复杂的内容和文本。Twitter 拥有大量可以训练 LLM 的数据。此前,ChatGPT 的创建者 OpenAI 可以访问 Twitter 数据用于训练目的,不过,后来在去年 12 月份,马斯克表示他停止了这种访问。

Image

目前还不清楚 Twitter 创建生成式人工智能的具体方式,也不知 TwitterGPT 是否会真的到来。

不过,有知情人士表示,马斯克这次大量购买 GPU,足以彰显他一心想要干好生成式 AI 的决心。因为放眼全球 GPU 市场,英伟达一家独大,占据 95% 的市场份额,它为大型 AI 模型制造的 GPU 一块售价就得 10,000 美元。

知识荟萃/研究成果

1.Google Bard 大更新!我们用 GPT-4 给它出了 20 道题

4月11日,来自 Google 的大语言生成类 AI 模型 Bard 又迎来更新,新增了「Google it」按钮,增强了数学与逻辑能力,并发布了一个全新的功能更新公告板。

三个更新点,做数学题是重点。Bard 的数学和逻辑能力得到了升级,以前一道 123456*654321 就开始乱说的大语言模型终于站起了身,并在GPT-4 出的 20 道题的考验中,Bard获得了 满分。

我们也把同样的问题翻译成中文去提问了百度的文心一言和阿里的通义千问,10 道数学题,通义千问仅对 1 题,文心一言则对了 4 题;10 道逻辑判断,通义千问 3 题正确略胜一筹,文心一言 2 题正确屈居第二。

Image

不得不说,数理计算对大语言模型来说,门槛确实比较高。

为了让用户更方便地了解 Bard 更新变化,Google 上线了 experiment updates(实验更新)界面,展示 Bard 的最新消息。

网址如下:https://bard.google.com/updates
感兴趣的朋友可以在下方地址体验。https://bard.google.com/

Image

商汤科技在2019年第一次推出了自研的CV(计算机视觉)模型,用10亿的参数规模实现了当时业界最好的算法效果。

两年之后,商汤开始训练30亿参数的多模态大模型“书生”,并在2022年开源。

4月10日,商汤科技CEO徐立出现在临港AIDC的现场,背后是一张AI生成的图案,画面上是一个人类宇航员正在走入一个新的科技世界。

Image

这个在复杂而具体的商业场景中成长起来的中国AI公司,正式拉开了自己的大模型叙事。

徐立在现场实时演示了如何用“商量”来完成童话故事的续写、邀请函的文本创作和细节修改。在展示中,“商量”已经具备相当的逻辑推理能力,并且在多轮对话中展现了不错的上下文理解水平。

Image

图源:商汤科技

商汤科技也展示了语言大模型支持下的几项创新应用,比如帮助开发者更高效地编写和调试代码,或者为用户提供个性化的医疗建议。

值得一提的是,“商量”在短时间内完成了对一整部《专利法》的理解,并且能够顺利的从中提取和概括信息来回答问题,答案准确。这显示这个语言大模型也具备了一定的对超长文本的理解能力。

基于这个大语言模型,商汤科技发布了包括AI文生图创作、2D/3D数字人生成、大场景/小物体生成等一系列自研的生成式AI应用。

  • 文生图创作平台 “秒画SenseMirage”展现了光影真实、细节丰富、风格多变的强大文生图能力,可支持6K高清图的生成;客户还可根据自身需求训练生成模型;

  • AI数字人视频生成平台“如影SenseAvatar”仅需一段5分钟的真人视频素材,就可以生成出来声音及动作自然、口型准确、多语种精通的数字人分身。

  • “琼宇SenseSpace”和“格物SenseThings”则是两个3D内容生成平台。

从“秒画SenseMirage”、“如影SenseAvatar”到“琼宇SenseSpace”和“格物SenseThings”,可被视为一个完整的视频内容的制作和生成工具平台。人、物到空间的数字化闭环都包含在这套生成式AI应用矩阵里。将为未来短视频、直播产业带来生产力的提升。这些都归于商汤科技“日日新SenseNova”的大模型体系之下。

3.重磅!阿里巴巴所有产品未来将接入大模型全面升级

阿里巴巴集团董事会主席兼CEO、阿里云智能集团CEO张勇在云峰会上表示,阿里巴巴所有产品未来将接入“通义千问”大模型,进行全面改造。

他认为,面向AI时代,所有产品都值得用大模型重新升级。

张勇表示,AI大模型的出现是一个划时代的里程碑,人类将进入到一个全新的智能化时代,就像工业革命一样,大模型将会被各行各业广泛应用,带来生产力的巨大提升,并深刻改变我们的生活方式。

自2019年起,阿里即开始进行大模型研究,并在近期展示了阶段性的研究成果:通义千问大模型。

目前,钉钉、天猫精灵等产品已接入通义千问测试,将在评估认证后正式发布新功能。

—The end—

声明:以上仅做个人分享,不构成投资建议。