GenAI新世界

6月13日 AI 头条|苹果市值重回全球第一,正努力将 Apple Intelligence 引入中国

Image
划重点:
  • 苹果市值重回全球第一,正努力将Apple Intelligence引入中国
  • 马斯克撤回针对OpenAI的诉讼
  • 苹果将把 ChatGPT 引入iOS 18,但不会向 OpenAI 支付费用
  • 视频生成模型 Dream Machine 宣布开放测试,可生成120帧视频
  • 消息称联发科正在为微软 AI 笔记本设计 Arm 架构芯片
  • Stable Diffusion 3 Medium 正式开源
  • Suno开放音频输入功能,可根据歌曲片段创作
  • Midjourney 版本更新,增加个性化微调功能
  • OpenAI 发布公告,介绍用户数据安全保护方案
  • 小爱同学与火山引擎达成合作,基于豆包推出全新 AI 交互体验
  • Midjourney 版本更新,增加个性化微调功能
资讯详情:
苹果市值重回全球第一,正努力将 Apple 智能引入中国
据 Fast Company 报道,苹果软件工程主管 Craig Federighi 表示苹果正在寻找一种方法将Apple Intelligence带去给所有客户,并透露正在推进这个过程。
Apple Intelligence 将于今年秋季开始在美国进行测试,想要测试Apple Intelligence,用户还需要进入候补名单,并且在部份地区的用户响应速度将会异常缓慢。
Image
马斯克撤回针对OpenAI的诉讼
据 AI jazeera 报道,马斯克今日撤销了对 OpenAI 及其高管Sam Altman和 Greg Brockman 的诉讼。
马斯克方面并没有对撤回诉讼给出任何理由。关于 OpenAI 驳回此案动议的听证会原定于周三举行。
Image
苹果将把 ChatGPT 引入iOS 18,但不会向 OpenAI 支付费用
据 9to5mac 报道,苹果与 OpenAI 的合作预计不会为任何一方带来有意义的收入,苹果不会付钱给 OpenAI,OpenAI 也不会付钱给苹果。
据报道,双方的合作包括在苹果的 Siri 和新的写作工具中加入数字助理 ChatGPT,它能以简单的语言回应信息请求。由于交易条款不公开,苹果不会向 OpenAI 支付合作费用。苹果认为将OpenAI的品牌和技术推广到数以亿计的设备上与金钱支付具有同等或更大的价值。
Image
视频生成模型 Dream Machine 宣布开放测试,可生成120帧视频
据 Luma AI 官方消息,Luma AI 旗下视频生成模型Dream Machine现已开放测试,用户可以免费体验。
Dream Machine可以根据文本和图像快速制作出高质量、逼真的视频。这是一款高效且具有高扩展性的视频生成模型,直接通过视频数据进行训练,可以生成具备真实物理效果的视频画面。
Image
消息称联发科正在为微软 AI 笔记本设计 Arm 架构芯片
据 trendforce 报道,联发科正在开发一款基于 ARM 的 PC 芯片,该芯片将运行微软的 Windows 操作系统。
上个月,微软发布了新一代笔记本电脑,采用基于 ARM 的芯片,为运行人工智能应用提供了足够的计算能力。微软高管表示,这代表了消费计算的未来趋势。据说,联发科最新开发的基于 ARM 的 PC 芯片就是针对这类笔记本电脑的
Image
Stable Diffusion 3 Medium 正式开源
Stability AI 正式宣布,Stable Diffusion 3 Medium现已开源,这是 Stable Diffusion 3 系列中最新、最先进的文本转图像 AI 模型!
Stability AI 表示,Stable Diffusion 3 Medium代表了生成式人工智能发展的一个重要里程碑,并延续了Stability AI致力于使这项强大技术民主化的承诺。
Image
Suno开放音频输入功能,可根据歌曲片段创作
Suno AI 今天宣布,正式开放音频输入功能,所有Pro 和 Premier 用户现在都可以使用这个功能。
音频输入功能允许用户利用任何声音来制作歌曲。用户可以上传或录制自己的音频,制作任何您能想到的歌曲。需要注意的是,用户在社交平台上发布 Suno 生成的音乐时需要进行标记。
Image
Midjourney 版本更新,增加个性化微调功能
据 Midjourney 官方消息,Midjourney现已发布全新版本,推出全新个性化微调功能。
Midjourney 表示,新功能将允许用户根据自己的审美偏好对MJ模型进行微调。模型会在用户输入提示词时根据用户习惯来填补未明确表述的部分内容。这些习惯来自用户此前生成的图片内容。
Image
OpenAI 发布公告,介绍用户数据安全保护方案
OpenAI 今天发布公告,介绍了保护用户数据安全的保护方案。OpenAI 表示,虽然用户数据的可以帮助他们改善现有模型的性能,但也理解那些不希望OpenAI 利用其个人数据的用户。为了保护这些用户的数据隐私,他们提出了多项措施。
首先,ChatGPT 免费版和增强版用户可以在设置中选择是否将他们的对话用于训练数据。其次,在 ChatGPT 中,用户可以选择"临时聊天记录 ",其数据不会被用于训练OpenAI的模型。另外 OpenAI 表示,公司默认不对 API、ChatGPT Enterprise 和 ChatGPT Team 客户数据进行训练。
Image
小爱同学与火山引擎达成合作,基于豆包推出全新 AI 交互体验
据火山引擎官方消息,小米旗下人工智能助手“小爱同学”与火山引擎达成合作,双方基于豆包大模型为用户带来更智能的 AI 交互体验。
“小爱同学”作为小米公司倾力打造的智能助手,已经成功融入手机、智能家居、智能穿戴设备以及小米 SU7 等众多小米产品中,提升了用户的日常交互便捷性。借助了豆包大模型提升自身模型的学习与推理能力,共同构筑了“小爱同学”的超凡智慧。全新的“小爱同学”不仅更加精准地把握用户需求,还以更快的响应速度和更全面的内容服务,为用户带来更加智能、便捷的体验。
Image
今日重点论文:
纽约大学:
《Compute Better Spent: Replacing Dense Layers with Structured Matrices》
本论文旨在探索替代密集矩阵的结构化矩阵,以提高基础模型的计算效率,并比较不同结构的性能和计算效率。论文使用Maximal Update Parameterization的见解确定了这些非传统层的最佳初始化和学习速率的比例,并测量了不同结构的缩放规律,比较了它们的性能和计算效率。
论文地址:
https://arxiv.org/abs/2406.06248v1
香港大学
《Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation》
本论文试图探讨在视觉生成领域中,无归纳偏见的自回归模型是否可以通过适当的扩展实现最先进的图像生成性能。其主要目的是在图像生成任务中应用原始的“下一个令牌预测”模型,即LlamaGen,以解决当前图像生成领域中的问题。本文的关键思路是将大型语言模型的原始“下一个令牌预测”范例应用于视觉生成领域。作者重新审视了图像分词器的设计空间、图像生成模型的可扩展性属性以及它们的训练数据质量。
论文地址:
https://arxiv.org/abs/2406.06525v11
东京大学
《Toward Autonomous Driving by Musculoskeletal Humanoids: A Study of Developed Hardware and Learning-Based Software》
论文旨在通过肌肉骨骼人形机器人实现自动驾驶,解决了如何让机器人在汽车上操作踏板和方向盘的问题。通过使用肌肉骨骼人形机器人的硬件和软件,实现了自动驾驶中的踏板和方向盘操作。
论文地址:
https://arxiv.org/abs/2406.05573v1
苹果
《Ferret-UI: Grounded Mobile UI Understanding with Multimodal LLMs》
本文旨在解决多模态大型语言模型(MLLMs)在理解和有效交互用户界面(UI)屏幕方面的不足。本文提出了Ferret-UI,一种新的MLLM,专门针对移动UI屏幕进行了优化,具备指代、基础和推理能力。本文采用了“任何分辨率”的方法来放大细节和提高视觉特征,同时还编译了包括图标识别、查找文本和小部件列表等基本UI任务的数据集,并使用区域注释格式化这些样本,以便进行精确的指代和基础。
论文地址:
https://arxiv.org/abs/2404.05719v1
Image