GenAI新世界

6月3日 AI 头条|AMD 公布 2024~2026 年 Instinct GPU 加速器路线图

Image

划重点:
  • AMD 公布 2024~2026 年 Instinct GPU 加速器路线图
  • Huggingface 被曝存在安全漏洞,部分用户密钥泄露
  • ElevenLabs 推出新 AI 工具,为视频添加音效
  • 英伟达推出数字孪生地球 Earth-2,可精准预测天气信息
  • 英伟达计划明年升级 Blackwell 芯片,后年推出新一代 AI平台
  • Stability AI 宣布 SD3将于下周开源
  • ChatTTS 官网上线,用户可直接体验
  • Perplexity AI 推出 Pages 功能,可将搜索结果转为报告
  • Midjourney 宣布成立硬件团队
资讯详情:
AMD 公布 2024~2026 年 Instinct GPU 加速器路线图
AMD 今天公布了2024年到 2026 年的 Instinct GPU AI 加速器路线图。AMD 宣布其 Instinct 产品线更新节奏调整与英伟达相同的一年一更,以满足不断扩张的 AI 应用需求。
AMDInstinct MI325X 加速器将在今年四季度率先上市 ,其可视为 MI300 更换 HBM3E 内存的刷新版本。该加速器内存容量将从 MI300X 的 192GB 提升至 288GB,同时内存带宽也从 5.3TB / s 小幅增加至 6TB / s。
AMD还 将在 2025 年推出下一代 MI350 加速器系列的首款产品 MI350X。MI350X 将采用 3nm 工艺,基于 CDNA4 架构,同样包含 288GB HBM3E 内存。AMD 预计将在2026 年推出基于 CDNA "Next" 架构的 Instinct MI400 加速器系列。
Image
Huggingface 被曝存在安全漏洞,部分用户密钥泄露
据 TechCrunch 报道,Hugging Face 近日表示,其安全团队检测到"未经授权访问 "Hugging Face用于创建、共享和托管人工智能模型和资源的平台Spaces。
Hugging Face 在一篇博客文章中说,这次入侵与 Spaces 秘密有关,即作为解锁账户、工具和开发环境等受保护资源的密钥的私人信息,它 "怀疑 "一些秘密可能在未经授权的情况下被第三方访问。
作为预防措施,Hugging Face 已撤销了这些机密中的一些代币。(Hugging Face称,令牌被吊销的用户已经收到了一封电子邮件通知,并建议所有用户 "刷新任何密钥或令牌",并考虑改用细粒度访问令牌,Hugging Face称这种令牌更安全。
Image
ElevenLabs 推出新 AI 工具,为视频添加音效
据 ElevenLabs 官方消息,ElevenLabs推出一款名为Sound Effects的新 AI 工具,可以为视频添加音效。
据悉, Sound Effects 可以根据文本生成最长22秒的音效,并与原本的视频结合使用。该工具利用Shutterstock的音频素材库训练,其素材库来自OpenAI、meta 等知名公司。Sound Effects提供免费和付费两种版本,付费用户生成的音效可用于商业用途,而免费用户则需在标题中标注来源elevenlabs.io。
Image
英伟达推出数字孪生地球 Earth-2,可精准预测天气信息
据英伟达官方消息,英伟达 CEO 黄仁勋在昨晚的演讲中,正式介绍了英伟达推出的数字孪生地球 Earth-2。
Earth-2主要用于天气观测,基于英伟达 CorrDiff 生成式 AI 模型技术,号称融合了人工智能、物理模拟和观测数据,够从今天的数据来预测未来世界的影响。
英伟达表示,相对于第一代 Earth 数字孪生地球,Earth-2 能够以 12 倍解析度精确预测天气信息,号称能够代表区域天气预测的巨大飞跃,同时据称能够提高 3000 倍能源效率。
Image
英伟达计划明年升级 Blackwell 芯片,后年推出新一代 AI平台
据英伟达官方消息,英伟达 CEO 黄仁勋昨天在演讲中介绍了英伟达的发展路线图,在AI 芯片方面,英伟达将会保持一年一款的节奏。
黄仁勋透露,随着 Blackwell 芯片开始生产,英伟达计划每年升级 AI 加速器和 AI 芯片,预计将于 2025 年推出 Blackwell Ultra,在 2026 年推出名为Rubin的下一代 AI 平台,该平台将采用 HBM4 内存。
Image
Stability AI 宣布 SD3将于下周开源
Stability AI 今天宣布,其Stable Diffusion 3 Medium 文生图模型将会在6月12日开源。
Stable Diffusion3Medium 是Stability AI 最新推出的产品,预计将为用户带来更加稳定和高效的使用体验。该模型规格参数达到了20亿,可以给用户带来更真实的图片体验。
Image
ChatTTS 官网上线,用户可直接体验
ChatTTS 近日正式宣布上线官网,所有用户均可以直接在线上体验。
ChatTTS 是一款语音生成模型,可以利用文字来直接生成语音。用户在文本框输入文字后,ChatTTS会生成对应的语音,并自动调整韵律和停顿。用户还可以利用Audio Seed功能来调节相应的音色,并为生成的语音内容增加笑声和停顿等功能。
Image
Perplexity AI 推出 Pages 功能,可将搜索结果转为报告
据 Perplexity AI 表示,他们为旗下搜索引擎推出名为 Pages 的全新 AI功能,可根据搜索结果生成一份内容详尽的报告。
Pages 可以帮助用户将搜索结果根据不同的受众类型生成内容细节度不同的报告或者指南。它还可以根据某个副标题来增加内容。Perplexity 还可以帮助您查找和插入相关的媒体项目,如图片和视频。
Image
Midjourney 宣布成立硬件团队
据 Midjourney 创始人David Holz表示,Midjourney 已成立新的硬件团队。
目前 Midjourney 并未公布该硬件团队的成立目的,也未公布任何关于该团队的人事信息。有消息称,Midjourney 可能在考虑为 AR 和 VR 创建完全由计算生成的世界,这是基于他们在文本转换为 3D 模型方面的工作。
Image
今日重点论文:
滑铁卢大学:
《MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series》
开源一个可透明的双语语言模型,解决当前开源语言模型在推理、知识和编程任务上表现不如闭源模型的问题。MAP-Neo是第一个完全开源的双语语言模型,其性能与目前闭源模型相当,提供了清理后的预训练语料库、数据清理流程、检查点和优化的训练/评估框架。该模型的开源将有助于加强开放研究社区,激发更多的创新和创造力,促进LLM的进一步改进。
论文地址:
https://arxiv.org/abs/2405.19327v2
Borealis AI
《Attention as an RNN》
论文旨在解决Transformer在推理时计算成本高的问题,限制了它们在低资源环境下的应用。论文提出了一种新的计算注意力的方法,使得注意力可以看作是具有计算其有效的many-to-one RNN输出的特殊RNN,并且将注意力模型视为RNN变体。同时,论文还引入了一种新的有效方法来计算注意力的many-to-many RNN输出,使得Aaren可以像Transformer一样进行并行训练,并且像传统RNN一样可以高效地更新新的标记,仅需要常数内存进行推断。
论文地址:
https://arxiv.org/abs/2405.13956v1
谷歌
《Robust Preference Optimization through Reward Model Distillation》
本文旨在解决DPO方法在使用单一或极少标注的偏好数据时,容易出现过度自信的问题,导致退化策略的情况。因此,本文提出了一种基于蒸馏的方法,以更好地近似偏好分布。本文的关键思路是通过训练语言模型产生的概率来匹配由偏好数据训练出来的奖励模型所诱导的分布,以获得更好的偏好分布近似,并通过优化奖励模型族来解决奖励模型不确定性的问题。
论文地址:
https://arxiv.org/abs/2405.19316v1
斯坦福大学
《On Fairness of Low-Rank Adaptation of Large Models》
LoRA的计算效率相比于全模型微调的高昂成本引起了研究人员的关注。本文旨在探讨LoRA对不同子群体中的公平性、校准性和抵抗成员推理的影响,以及与全模型微调基准的比较。
本文通过实验研究发现,LoRA相对于全模型微调的公平性影响是不确定的,有时会加剧模型的偏差,但在许多情况下,LoRA的公平性甚至更好。同时,本文还探讨了评估微调公平性时的复杂性,呼吁未来进行更加谨慎的公平性评估。
论文地址:
https://arxiv.org/abs/2405.17512v1