GenAI新世界

3 月 25日 AI 头条:百度或将为苹果国行 iPhone 设备提供AI功能支持

Image

划重点:

  • 百度或将为苹果国行 iPhone 设备提供AI功能支持
  • 消息称苹果研究人员正探索免唤醒词呼叫 Siri,用 AI 聆听取代

  • AI 作曲编曲工具 Suno V3 亮相:可免费创作多种风格歌曲还能唱

  • 口袋 AI 设备 Rabbit R1 月底向首批美国买家发货:无需配对手机,堪称万能应用控制器

  • 东莞市与百度签署战略合作协议,涉及人工智能、新能源汽车等领域

  • 网友反馈微软 Copilot 引用谷歌 Gemini 内容,点击链接无法跳转指定内容页面

  • 基于 Gemini,谷歌宣布将为 Pixel / Fitbit 智能手表手环打造“个人健康 AI 大模型”

  • 消息称三星电子年底前向 Naver 交付 AI 芯片 Mach-1,交易额至高 1 万亿韩元

资讯详情:

百度或将苹果为国行 iPhone 设备提供AI功能支持

据科创板日报报道,百度将会为苹果今年发布的iPhone 16、Mac系统和iOS 18提供AI功能。

苹果曾与阿里以及另外一家国产大模型公司进行过洽谈,最后确定由百度提供这项服务。苹果预计采取API接口的方式计费。苹果将国行iPhone等设备采用国产大模型AI功能主要出于合规需求,该公司短期内还无法解决合规问题,但国外版iPhone等设备AI功能均来自苹果自己的大模型。

消息称苹果研究人员正探索免唤醒词呼叫 Siri,用 AI 聆听取代

据《麻省理工科技评论》报道,当地时间周五(22)日发表的一篇论文显示,苹果公司的研究人员正在探索利用人工智能来检测用户何时在与 iphone 等设备交谈的可能性,从而消除像“Siri”这样的触发短语的技术需求。

在这项上传到 Arxiv 且未经同行评审的研究中,研究人员使用智能手机捕获的语音以及来自背景噪音的声学数据,训练了一个大型语言模型,以寻找“可能表明用户需要设备辅助”的模式。

论文中称,该模型部分基于 OpenAI 的 GPT-2 构建,因为它相对轻量级,可以在智能手机等设备上运行。论文还描述了用于训练模型的超过 129 小时的数据、额外的文本数据,但没有说明训练集的录音来源。据领英个人资料,七位作者中有六位列出他们的隶属关系为苹果公司,其中三人在苹果 Siri 团队工作。

Image


AI 作曲编曲工具 Suno V3 亮相:可免费创作多种风格歌曲还能唱

据 TGStat 报道,一家 AI 初创公司 Suno 近日发布了首款能够生成“广播级”歌曲的工具,能够在数秒之内创作出两分钟的完整歌曲,所有用户均可免费访问。

该平台最令人惊奇之处,就是在用户给出指定歌词之后能够生成不同曲风、流派的歌曲,甚至可以指定 AI 歌手的音色。官方还表示,V4 已经在开发中,“我们正在夜以继日地开发一些令人兴奋的新功能”。

该平台宣称,Suno 专为创作原创音乐而设计,模型无法识别其他艺术家的作品,Suno 不是为了制作更多的 Fake Drakes(AI 生成的德雷克“演唱”作品《Heart On My Sleeve》)而生的。

Image

口袋 AI 设备 Rabbit R1 月底向首批美国买家发货:无需配对手机,堪称万能应用控制器

据 Eet-China 报道,曾在今年 CES 大展期间引起轰动的口袋 AI 设备 ——Rabbit R1 将要发货了。

Rabbit 官方上周六宣布,正在按计划于 3 月 31 日复活节当天将首批美国用户订购的产品运出工厂。由于订单需通过海关,预计发货时间超过 3 周,首批订单将于 4 月 24 日左右到达当地客户手中。“我们迫不及待,想要让您亲身体验 R1!”

Image

东莞市与百度签署战略合作协议,涉及人工智能、新能源汽车等领域

据百度官方消息,3 月 22 日,东莞市人民政府与百度签署战略合作协议,双方将围绕人工智能产业发展,推动人工智能的全场景应用落地。

根据合作协议,双方将聚焦东莞市电子信息、高端装备、新能源汽车等重点产业,提升企业研发、生产环节的人工智能水平。

李彦宏表示,希望双方进一步深化互利合作,加快推动人工智能技术在各个领域的应用,促进人工智能同服务业、制造业深度融合。

Image


网友反馈微软 Copilot 引用谷歌 Gemini 内容,点击链接无法跳转指定内容页面

Reddit 网友近日发布帖子,表示微软旗下的 Copilot 在其参考信息中,引用了来自谷歌 Gemini 的数据。

用户反馈这就导致了混乱,点击 Copilot 中的链接,并不会跳转到 Copilot 引用的指定信息内容,而是会跳转到 Gemini 的主页。

用户对此的反应不一,有些人的观点认为:Copilot 应该只能引用来自 Bing 搜索的内容,不应该和 Gemini 等其它聊天机器人有所交互;而另外一些人认为 Copilot 可以和其它聊天机器人交互,为用户提供更丰富、全面的信息。

Image


基于 Gemini,谷歌宣布将为 Pixel / Fitbit 智能手表手环打造“个人健康 AI 大模型”

据谷歌官方新闻稿,谷歌近日宣布旗下 Google Research 将携手 Fitbit 团队建立一款“个人健康大语言模型(Personal Health Large Language Model)”,该模型将用于谷歌Pixel / Fitbit 智能手表手环,以改善系列智能设备的健康追踪功能。

新闻稿显示,这款个人健康大语言模型将以 Gemini 模型为基础,再利用一系列健康方面的数据集进行微调,号称能够让模型“展现对人类生理及行为数据的深刻推论能力”。

Image


消息称三星电子年底前向 Naver 交付 AI 芯片 Mach-1,交易额至高 1 万亿韩元

据韩媒 hankyung 报道,三星计划年底向韩 IT 巨头 Naver 出货 AI 芯片 Mach-1,交易额至高 1 万亿韩元。

近日三星电子 DS 部门负责人庆桂显宣称,Mach-1 目前处于 SoC 设计阶段,三星计划在今年底完成该 AI 芯片的制造过程。

Mach-1 基于非传统结构,可将其核心计算芯片同 LPDDR 片外内存间的瓶颈降低至现有 AI 芯片的 1/8,同时能耗也只是英伟达竞品的 1/8。

Image

今日重点论文:

剑桥大学:

《Why do Random Forests Work? Understanding Tree Ensembles as Self-Regularizing Adaptive Smoothers》

论文提供了一种新的量化决策树集成的平滑度的方法,并对决策树集成的优势进行了进一步的解释。研究表明,决策树集成可以通过三种不同的机制提高性能,即减少噪声引起的预测方差、减少给定固定输入数据时学习函数质量的变异性,以及通过丰富可用的假设空间减少潜在的偏差。

论文地址:

https://arxiv.org/abs/2402.01502v1


谷歌:

《HeAR - Health Acoustic Representations》

本文提出的HeAR是一种基于自监督学习的深度学习系统,通过线性探针在6个数据集上的33个健康声学任务中,将其建立为最先进的健康音频嵌入模型。本文的亮点是使用大型数据集进行自监督学习,提出了一种可扩展的深度学习系统,以解决健康声学数据的局限性和瓶颈问题。通过线性探针,本文在多个数据集上展示了HeAR的性能优越性。本文的代码和数据集已公开。

据时学习函数质量的变异性,以及通过丰富可用的假设空间减少潜在的偏差。

论文地址:

https://arxiv.org/abs/2403.02522v1


康奈尔大学:

《Diffusion Models Without Attention》

论文提出了一种名为DiffuSSM的新型架构,将注意力机制替换为更可扩展的状态空间模型骨干,有效地处理更高分辨率的图像,同时保留了详细的图像表示。论文在ImageNet和LSUN数据集上进行了全面的评估,证明了DiffuSSMs在FID和Inception Score指标上与具有注意力模块的现有扩散模型相当甚至更优,同时显著降低了总FLOP使用量。

论文地址:

https://arxiv.org/abs/2311.18257v1


卡耐基梅隆大学:

《Repetition Improves Language Model Embeddings》

本文的关键思路是使用“回声嵌入”来解决自回归大型语言模型中的架构限制,从而最大化利用高质量的LLMs进行嵌入提取。本文的实验结果表明,“回声嵌入”可以在MTEB排行榜上将零-shot的表现提高9%以上,并在微调后提高约0.7%。使用Mistral-7B模型的“回声嵌入”实现了与不利用合成微调数据的先前开源模型相比的最新成果。值得注意的是,本文提出的方法非常简单,易于实现。

论文地址:

https://arxiv.org/abs/2402.15449v1


南开大学:

《Sora Generates Videos with Stunning Geometrical Consistency》

本文使用将生成的视频转换成3D模型的方法,通过评估模型的几何约束的准确性来衡量生成的视频符合真实物理规则的程度。论文提出了一个新的基准来评估视频生成模型的真实物理准确性,并使用了将生成的视频转换成3D模型的方法来衡量其准确性。论文还提供了项目页面和代码。

论文地址:

https://arxiv.org/abs/2402.17403v1

Image