GenAI新世界

3 月 22日 AI 头条:微软发布首款 AI PC 产品,起售价1199美元

Image

划重点:

  • 微软发布首款 AI PC 产品,起售价1199美元
  • OpenAI 被曝审核政策存在漏洞,GPT 商店充满侵权和垃圾内容
  • 联合国大会通过首个有关 AI 的决议草案
  • Suno正式发布V3音乐生成模型
  • 微软将以6.5亿美元收购Inflection AI 获得后者大模型的使用权
  • Stable Diffusion核心团队被曝集体离职 
  • 腾讯发布 GiiNEX AI 游戏引擎:面向 AI NPC、场景制作与内容生成
  • 淘宝“星辰”大模型亮相,布局电商和生活服务场景
  • 联想宣布 4 月 18 日在创新科技大会发布 AI PC 新品
资讯详情:
微软发布首款 AI PC 产品,起售价1199美元
微软宣布推出首批专为商业用户打造的Surface人工智能电脑:Surface Pro 10商用版和Surface Laptop 6 商用版。
两款AI PC均配备了最新的英特尔酷睿Ultra处理器,并拥有加快执行AI任务的NPU。微软还对PC键盘进行了处理,添加了专用的CoPilot键。两款 AI PC 均将在4月9日上市,起售价1199美元。
Image
OpenAI 被曝审核政策存在漏洞,GPT 商店充满侵权和垃圾内容
OpenAI的官方GPT市场被曝充斥着各种奇形怪状、可能侵犯版权的GPT这意味着OpenAI的审核工作很不严格。
据报道,粗略搜索一下就会发现一些 GPT 声称可以生成迪斯尼和漫威作品风格的艺术作品,但它们只不过是第三方付费服务的漏斗,而且还宣传自己可以绕过 Turnitin 和 Copyleaks 等人工智能内容检测工具。
Image
联合国大会通过首个有关 AI 的决议草案
当地时间 3 月 21 日,联合国大会投票通过了第一个有关人工智能(AI)的决议草案,以确保这项新技术能够惠及所有国家、尊重人权并且是“安全、可靠和值得信赖的”技术。
据了解,这项决议草案旨在消除发达国家和发展中国家之间的数字鸿沟,确保它们在人工智能讨论中处于同等地位,还旨在确保发展中国家拥有利用人工智能的技术和能力。
Suno正式发布V3音乐生成模型
Suno 今天宣布音乐生成模型 V3,相比前代,V3版本的音质得到显著提升,可以给用户带来更好的银屏体验。
此外,V3提供了更加丰富的音乐风格选择,可以让用户通过文字来生成不同风格的音乐,满足他们对于不同场景的需求。此外该版本该改善了用户指令响应效果。
Image
微软将以6.5亿美元收购Inflection AI 获得后者大模型的使用权
据参与微软和Inflection AI交易的人士透露,微软已同意向Inflection AI支付约6.5亿美元,主要以许可协议的形式,使Inflection AI的模型可以在Azure云服务上销售。
另一位知情人士称,Inflection AI正在利用许可费帮助其投资者获得适度的资本回报。除了6.2亿美元的许可费外,微软还同意向Inflection AI支付约3000万美元,以放弃与大规模招聘相关的任何合法权利。微软还与Inflection AI谈判了1.4亿美元的信贷额度,旨在帮助Inflection AI为其运营提供资金并支付微软服务费用。
Image
Stable Diffusion核心团队被曝集体离职
Stable Diffusion核心研究团队被曝已集体辞职,其成员包括研究团队领导、论文一作Robin Rombach,共同一作Andreas Blattmann,以及另一位作者Dominik Lorenz。
目前尚不清楚其离职原因,有消息称,Stability AI正因入不敷出且融不到新资金而陷入困境。根据此前的爆料,该公司每个月至少要花费800万美元来支持业务运营。去年年底,Stability AI还一度传出因财务状况压力而寻求出售的消息。
Image
腾讯发布 GiiNEX AI 游戏引擎:面向 AI NPC、场景制作与内容生成
腾讯近日在 GDC 2024 游戏开发者大会上,发布了 AI Lab 团队打造的 GiiNEX AI 游戏引擎,基于生成式 AI 和决策 AI 技术。
腾讯表示,GiiNEX AI 游戏引擎面向 AI NPC、场景制作、内容生成等场景,提供了包括 2D 图像、动画、3D 城市、剧情、对话、关卡以及音乐等 AIGC 能力,可被用于 MOBA、FPS、MMO 等各类游戏。
Image
淘宝“星辰”大模型亮相,布局电商和生活服务场景
据 Tech 星球消息,淘宝天猫集团自研大模型“淘宝星辰”官网已经上线。官网除了显示该大模型的介绍外,还设置有“立即体验”和“登录 / 注册”入口,预计在不久后对外开放。
据介绍,星辰大模型基于 Transformer 架构,采用半自研的 Megatron-ama 框架进行训练,从电商消费数据和公开数据中学习,能够给用户提供电商和生活服务场景增强的文案生成、多轮会话、知识问答、智能决策等能力。此举意味着,淘天集团正着手布局电商和生活服务场景的 AI 大模型赛道。
Image
联想宣布 4 月 18 日在创新科技大会发布 AI PC 新品
据联想官方消息,联想将于 4 月 18 日在联想创新科技大会上发布 AI PC 新品。
联想集团执行副总裁兼中国区总裁刘军表示,联想坚持全栈 AI 战略,推动 AI 内嵌的智能终端、AI 导向的基础设施与 AI 原生的方案服务发展。联想表示,PC 行业即将迎来继“家用电脑”、“互联网电脑”后的第三次代际升级,即基于大模型技术的 AI PC 时代。
Image
今日重点论文:
卡内基梅隆大学:

《Zero-Shot Multi-Object Shape Completion》

研究团队提出了OctMAE,这是一种利用Octree U-Net和潜在3D MAE的架构,通过局部和全局几何推理实现高质量和接近实时的多物体形状完成。为了解决潜在空间中的计算和内存问题,论文采用了遮挡掩模策略和3D旋转嵌入。该研究旨在解决从单个RGB-D图像中恢复复杂场景中多个对象的完整几何形状的问题。即使在单个物体的3D形状完成方面取得了明显的进展,但在高度混乱的现实多物体场景中实现高质量重建仍然是一个挑战。
论文地址:
https://arxiv.org/abs/2403.14628v1
蒙纳士大学:

《MVSplat: Efficient 3D Gaussian Splatting from Sparse Multi-View Images》

本论文旨在提出一种高效的前馈3D高斯Splatting模型,通过稀疏的多视角图像进行学习,以解决3D场景重建的问题。本文提出了通过在3D空间中进行平面扫描构建代价体表示,从而准确定位高斯中心,并通过代价体中存储的跨视图特征相似性提供有价值的几何线索来估计深度的方法。
论文地址:
https://arxiv.org/abs/2403.14627v1
马里兰大学:

《LiFT: A Surprisingly Simple Lightweight Feature Transform for Dense ViT Descriptors》

本文旨在提出一种简单的自监督方法,以增强ViT特征在密集下游任务中的性能。具体而言,如何提高ViT特征的密度,以便在关键点对应、检测、分割和对象发现等任务中获得更好的性能。研究团队提出了一种名为LiFT的后处理网络,可以应用于增强任何预训练的ViT骨干网的特征。LiFT是一种快速且易于训练的自监督方法,可以在最小的额外推理成本下提高ViT特征的密度。LiFT通过多个应用可以提高特征的尺度不变性和更好的对象边界映射。
https://arxiv.org/abs/2403.14625v1
西北大学:

《ODTFormer: Efficient Obstacle Detection and Tracking with Stereo Cameras Based on Transformer》

研究团队提出ODTFormer,一个基于Transformer的模型,旨在解决机器人自主导航中的障碍物检测和跟踪问题。ODTFormer利用可变形注意力构建3D成本体积,并以体素占用网格的形式逐步解码,以解决检测任务。然后通过匹配连续帧之间的体素来跟踪障碍物。整个模型可以以端到端的方式进行优化。相比于当前领域的研究,ODTFormer的关键思路是使用Transformer进行障碍物检测和跟踪。
论文地址:
https://arxiv.org/abs/2403.14626v1