GenAI新世界

4 月 18 日 AI 头条|联想发布业内首款AI PC个人智能体 包含多款核心应用

Image

划重点:

  • 联想发布业内首款AI PC个人智能体 包含多款核心应用

  • 华为 Pura 70 Ultra / Pro 手机今日先锋开售

  • 亚马逊云集齐 Claude 3 全家桶

  • 微软对 OpenAI 巨额投资据悉不会遭到欧盟调查

  • 蚂蚁集团、OpenAI、科大讯飞等联合编制 大模型安全国际标准发布

  • 钉钉 AI 助理市场上线 近 200 +助理首批上架

  • 亚马逊 Amazon Music 宣布开启 AI 生成歌单功能 Maestro 测试

  • Meta 的 Llama 2 LLM 被指安全性低:幻觉率达 48%

  • 马斯克的 AI 机器人 Grok 闹笑话,将球员投篮不中误解成“用砖头破坏房屋”

  • AI芯片需求继续强劲!台积电Q1净利润一年来首次增长

  • 波士顿动力宣布双足机器人 Atlas将退役并推出纯电动机器人

  • 微软 AI 框架 AutoDev 欲改变开发者角色:从“敲代码”变为项目“监管者”

  • 美团内测AI外卖助手问小袋

  • 抖音生活服务成立 AI 团队,试水AI应用

资讯详情:

联想发布业内首款AI PC个人智能体 包含多款核心应用

在4月18日联想创新科技大会上,行业首款AI PC个人智能体——联想小天正式发布。

联想同时发布了十余款核心应用,包括AI画师、AI PPT、文档总结、智会分身等。联想小天是用户专属的“个人智能体”,由嵌入本地的天禧大模型驱动,通过自然交互,在工作、学习和生活等诸多场景中带来新AI体验。同时,借助用户的本地文档,联想小天能够不断地加深对用户的认知和理解,从而提供更加精准和个人化的服务。

Image

华为 Pura 70 Ultra / Pro 手机今日先锋开售

华为今天宣布,推出“HUAWEI Pura 70 系列先锋计划”,Pura 70 Ultra 和 Pura 70 Pro 今日 10:08 先锋开售。

Pura 70 系列业界首创超聚光伸缩摄像头,拍照时开启专属仪式感;超聚光微距长焦,探索小世界的大精彩;人像、夜景、长焦、视频能力再进一步,为消费者带来更好的拍摄体验。此外,华为 Pura 70 Pro+、华为 Pura 70 手机将于4 月 22 日 10:08 先锋开售。

Image

微软对 OpenAI 巨额投资据悉不会遭到欧盟调查

据财联社报道,微软公司对 OpenAI 公司 130 亿美元的投资将避免受到欧盟兼并监管机构的正式调查,从而平息了人们对双方关系可能被迫破裂的担忧。

知情人士透露,欧盟委员会已经决定,这一合作不值得进行正式调查,因为不属于收购,而且微软并不控制 OpenAI 的发展方向。

微软引用了之前的一份声明,强调与 OpenAI 的合作促进了创新和竞争,同时保持了两家公司的独立性。欧盟委员会发言人强调,要解决任何竞争问题,都需要确定两家公司之间控制权的永久变更。

Image


亚马逊云集齐 Claude 3 全家桶

亚马逊云科技宣布,在 Amazon Bedrock 上正式推出来自 Anthropic 的 Claude 3 Opus 模型。

该模型是 Claude 3 家族中最智能的模型,在高度复杂的任务上表现卓越,并拥有惊人的流畅性和类似人类的理解能力,能够高效应对开放性提示和未知的全新场景。

至此,Amazon Bedrock 也成为了首个提供所有 Claude 3 系列模型的全托管服务,其中包括 Claude 3 Opus 和此前推出的 Claude 3 Sonnet 与 Claude 3 Haiku。

Image

蚂蚁集团、OpenAI、科大讯飞等联合编制 大模型安全国际标准发布

据TechWeb 报道,第27届联合国科技大会在瑞士日内瓦召开。世界数字技术院(WDTA)发布了一系列突破性成果,包括《生成式人工智能应用安全测试标准》和《大语言模型安全测试方法》两项国际标准。

据悉,这两项国际标准是由OpenAI、蚂蚁集团、科大讯飞、谷歌、微软、英伟达、百度、腾讯等数十家单位的多名专家学者共同编制而成。其中《大语言模型安全测试方法》由蚂蚁集团牵头编制。

此次发布的标准汇集了全球AI安全领域的专家智慧,填补了大语言模型和生成式AI应用方面安全测试领域的空白,为业界提供了统一的测试框架和明确的测试方法,有助于提高AI系统安全性,促进AI技术负责任发展,增强公众信任。

Image


钉钉 AI 助理市场上线 近 200 +助理首批上架

据钉钉官方消息,钉钉 AI 助理市场已经上线,目前已经有超过220万家企业在使用钉钉 AI,月活企业数超过170万家。

用户可以在钉钉搜索 “AI 助理市场”,选择启用超过200个 AI 助理,覆盖办公、生活、娱乐等多个场景。首批上架的近200个 AI 助理包括角色 AI 助理、专业 AI 助理、多任务处理 AI 助理和跨应用 AI 助理,涵盖了不同的功能和领域。

钉钉 AI 助理市场的 AI 助理可以与钉钉积累的 SaaS 应用、低代码应用生态连接,或者通过开放能力连接企业自建系统、外部第三方平台,让每个人、每家企业都能低门槛地创造 AI 助理。

Image


亚马逊 Amazon Music 宣布开启 AI 生成歌单功能 Maestro 测试

据ITBear报道,亚马逊宣布旗下 Amazon Music 音乐应用向少数美国用户开启 AI 生成歌单功能 Maestro 的测试。

用户可通过多样化的提示输入(包括传统的文字提示词、表情符号以及它们的组合)让该功能在数秒内生成独特的定制歌单。Maestro 在页面底部还列出了多个推荐提示词以供选用。

具体而言,如果用户输入🤖,那 Maestro 就会提供一个包含关于电子和机器人的曲目列表。

目前 Amazon Music 的 Unlimited 层级订阅用户在收获测试资格后可全量使用 Maestro 功能,在保存歌单前能无限制试听;而有测试资格的 Free 和 Prime 层级用户则仅可在保存前试听预览 30 秒。

亚马逊表示 Maestro 建立于新兴技术之上,不能保证正确性,同时亚马逊为该功能设置了 AI 围栏,阻止不恰当的提示输入。

Image


Meta 的 Llama 2 LLM 被指安全性低:幻觉率达 48%

AI 安全公司 DeepKeep 近日发布评估报告,在 13 个风险评估类别中,Meta 公司的 Llama 2 大语言模型仅通过 4 项测试。

报告称 70 亿参数的 Llama 2 7B 模型幻觉(回答内容存在虚假,或者有误导性内容)最为严重,幻觉率高达 48%。

DeepKeep 表示:“结果表明,模型有明显的幻觉倾向,提供正确答案或编造回答的可能性对半开,而幻觉率最高,那么向用户传递的错误信息越多”。

除了幻觉问题之外,Llama 2 大语言模型还存在注入和操纵等问题。根据测试结果,80% 的场景下通过“提示注入”的方式,可以操纵 Llama 的输出,意味着攻击者可以“戏弄”Llama,将用户引导到恶意网站。

Image


马斯克的 AI 机器人 Grok 闹笑话,将球员投篮不中误解成“用砖头破坏房屋”

昨晚,金州勇士队后卫克莱汤普森在对阵萨克拉门托国王队的比赛中投篮 10 投 0 中,导致球队无缘 NBA 季后赛。更让球迷哭笑不得的是,马斯克的社交媒体平台 X 的人工智能助手 Grok 生成了一条热门新闻(trending story),声称汤普森正在用砖块破坏该地区的房屋。

姑且不论篮球迷,就连普通观众也能轻易看出这则新闻的荒谬之处。然而,Grok 似乎没有那么聪明。它在看到用户大量讨论关于球员“投砖”(shooting bricks,即投篮不中)的帖子后,错误理解了这一球场术语,生搬硬套生成了一篇完全虚构的新闻报道。

这则荒谬的新闻一度登上了热搜榜第五名,内容煞有介事地写道:“克莱汤普森被指控在萨克拉门托使用砖块破坏多所房屋,相关执法部门正在对此展开调查。据悉,已有居民报告房屋窗户被砖块击碎。汤普森尚未对此事件发表声明,但当地居民深感不安。目前,行凶动机尚不清楚。” 尽管 Grok 在捏造新闻时还煞有介事地写下了“这是一起奇怪的事件”,但它仍然发布了这则离谱的新闻。

在该新闻的下方,X 还标注了“Grok 是一个尚在开发的初期功能,可能会出现错误。请核实其发布内容。”的信息,但仍不能阻止篮球爱好者们纷纷通过社交媒体发布帖子,用调侃的语气“核实”人工智能的错误言论。

对大多数人来说,Grok 的这次乌龙事件可能只是众多早期人工智能工具犯过的又一个错误。然而,对于像埃隆・马斯克一样坚信人工智能将在明年年底超越人类智慧的人来说,这则事件或许应该作为一个警示:人工智能仍然需要严格的事实核查。

Image

AI芯片需求继续强劲!台积电Q1净利润一年来首次增长

4月18日,台积电公布截至3月31日的2024年一季度业绩报告。在强劲的AI芯片需求提振下,全球最大芯片代工厂台积电一季度净利润好于预期,实现一年以来首次增长。

财报显示,台积电一季度净利润为2255亿元台币(约合69.76亿美元),预估2149.1亿元台币,同比增长8.9%,创下一年多以来最快增速;第一季度销售额5926.4亿元台币(约合183.33亿美元),同比增长17%,预估5834.6亿元台币。第一季度营业利润2490.2亿元台币(约合77亿美元),同比增长7.7%,预估2408.7亿元台币。

波士顿动力宣布双足机器人 Atlas将退役并推出纯电动机器人

知名机器人公司波士顿动力近日宣布,其双足液压机器人 Atlas 将退役,与此同时,公司推出全新的纯电动机器人Atlas。

据波士顿动力表示,新一代 Atlas 机器人拥有更广的运动范围,能够胜任更多任务。波士顿动力希望通过新版 Atlas 机器人证明,人形外形并不会限制机器人的双足移动能力。新版机器人的关节经过了重新设计,可以灵活旋转,据称能够“胜任乏味、脏污和危险的任务”。

Image
微软 AI 框架 AutoDev 欲改变开发者角色:从“敲代码”变为项目“监管者”

微软公司近日发表论文,概述了名为 AutoDev 的人工智能(AI)框架,希望实现完全自动化软件项目开发,让开发人员从中抽离出来成为“单纯的监管者”。

AutoDev 支持文件编辑、检索、构建流程、执行、测试和 git 操作等。AutoDev 框架可以自动分析软件项目的需求,合理搭配开发环境、自动开发和调试代码,只需要少量甚至不需要开发者就能自动化完成软件项目,让开发人员不再枯燥地敲代码,而是扮演“监督者”的角色,测试和审查 AI 生成的代码。

Image

美团内测AI外卖助手问小袋

据Tech星球报道,美团于近日测试了面向C端用户的AI助手服务“问小袋”。

据悉,“问小袋”是基于Raccoon model(浣熊大模型)的一款外卖智能助手产品,可以为用户进行餐饮推荐、提供送礼建议等服务,类似于导购助手。目前,“问小袋”已在美团外卖平台中开启小范围测试。

Image

抖音生活服务成立 AI 团队,试水AI应用

据Tech星球报道,抖音生活服务近日调集了生活服务的部分技术人员,组建了一支AI团队,探索AI与生活服务的场景结合。

抖音生活服务的AI能力当前主要应用于B端场景,其中,抖音来客APP已经上线多个AI功能,包括智能剪辑、短视频智能创作工具、智能图文创作等,为商家提供相关的AIGC智能营销和创作服务。

该团队位于北京、上海、成都三地,由算法+工程团队组成,具体的业务包括智能客服、内容创作、知识图谱等。

今日重点论文:

艾伦人工智能研究所:

《Accelerating the Science of Language Models》

OLMo提供了完整的框架,包括训练数据、训练和评估代码,以及一个真正开放的语言模型。这篇论文的亮点是提供了一个开放的框架,使研究人员能够更好地研究语言模型的偏差和潜在风险,并且鼓励开放研究社区的发展和创新。

论文地址:

https://arxiv.org/abs/2402.00838v2


同济大学上海智能自主系统研究院:

《Retrieval-Augmented Generation for Large Language Models: A Survey》

论文详细分析了RAG的演变,重点关注了三个关键范式:Naive RAG、Advanced RAG和Modular RAG。论文系统地研究了RAG系统的三个基本组件:检索器、生成器和增强方法,强调了每个组件内的尖端技术。此外,论文还介绍了评估RAG模型的新指标和能力,以及最新的评估框架。最后,论文从三个角度概述了未来的研究方向:未来的挑战、模态扩展以及RAG技术栈和生态系统的发展。

论文地址:

https://arxiv.org/abs/2312.10997v2


Apple:

《MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training》

本论文通过对图像编码器、视觉语言连接器和各种预训练数据选择的全面剖析,确定了几个关键的设计要点,并提出了一种新的预训练数据选择方法,通过大规模多模态预训练,建立了一个30B参数的多模态模型家族MM1,该模型在预训练指标上领先,并在多个基准测试中取得了竞争性能。

论文地址:

https://arxiv.org/abs/2403.09611v1


剑桥大学:

《Why do Random Forests Work? Understanding Tree Ensembles as Self-Regularizing Adaptive Smoothers 》

论文提供了一种新的量化决策树集成的平滑度的方法,并对决策树集成的优势进行了进一步的解释。研究表明,决策树集成可以通过三种不同的机制提高性能,即减少噪声引起的预测方差、减少给定固定输入数据时学习函数质量的变异性,以及通过丰富可用的假设空间减少潜在的偏差。

论文地址:

https://arxiv.org/abs/2402.01502v1


阿卜杜拉国王科技大学:

《Language Agents as Optimizable Graphs 》

本论文的关键思路是将LLM代理表示为计算图,并使用自动图优化器来改进节点级LLM提示和代理编排,从而提高多模态数据处理的效率。本论文的亮点在于提出了一种新的自动图优化器,可以改进节点级LLM提示和代理编排,同时可以将多个计算图递归地组合成更大的复合图,从而实现代理之间的协作。作者进行了实验来验证该框架的有效性,并开源了代码。值得继续深入研究。

论文地址:

https://arxiv.org/abs/2402.16823v2

Image