GenAI新世界

7月23日 AI 头条|马斯克19天建成世界最强AI训练集群,10万块液冷H100正式开工

划重点:
  • 马斯克19天建成世界最强AI训练集群,10万块液冷H100正式开工
  • Llama 3.1 疑似泄露,拥有4050亿参数
  • 番茄小说作者联合抵制AI 协议
  • 谷歌发布最新天气预报 AI 模型 NeuralGCM
  • Luma AI 发布新功能 Loops,可生成循环视频
  • LensGo AI推FaceSync功能,融合表情、声音和图像
  • 深圳推出全国首个司法审判大模型 AI辅助法官提升审判效率
  • 三星将押注 AI 未来,正研发新款AI手机
  • 努比亚推出自研星云大模型 号称编程性能国内排名第一
资讯详情: 马斯克19天建成世界最强AI训练集群,10万块液冷H100正式开工 马斯克在 X 上宣布,旗下超级计算机集群 Memphis Supercluster 已经在当地时间4:20开始训练。
Memphis Supercluster 由 100块 H100 GPU 组成,在单个RDMA结构上运行,是世界上最强大的 AI 训练集群。马斯克表示,利用Memphis Supercluster,他们将会在今年12月前训练处世界上最强大的 AI 。
Llama 3.1 疑似泄露,拥有4050亿参数 多位 X 及 Reddit 用户表示,Meta 即将发布的AI大模型Llama 3.1 已遭到泄露,其基准测试结果被曝光。 根据泄露的信息,Llama 3.1 拥有8B、70B和405B多个版本,而即便是70B的版本,其性能在基准测试中也超过 Gpt-4O模型。这是首次开源模型超越了 GPT4o 和 Claude Sonnet3.5等闭源模型,在多个 benchmark 上达到 SOTA。 目前Meta 尚未对泄露信息进行回复。
番茄小说作者联合抵制AI 协议 据蓝鲸新闻消息,近期有不少网文作者发帖表示,番茄小说签约协议中增加了AI 训练补充协议,要求作者同意把作品用作 AI 训练样本,从而用于平台内容开发。 有一位从事网络文学创作近十年的作者表示,番茄小说通常按本签约,在后台发满 2 万字就可以申请签约,然后等系统过一遍就会发来站内短消息。近期的合约里多了 AI 相关条款,站内也没提示,很多作者都是回头去查合约才发现自己在不知情的情况下已经签署了该合约。 对此,官方表示,对于已经签署补充协议、或签约条款中包含AI条款的作者,已开放相关通道,将协助作者尽快解除相关 AI 条款约定。
谷歌发布最新天气预报 AI 模型 NeuralGCM 据 Nature 显示,谷歌近日发表论文,介绍了一款最新推出的 AI 模型 NeuralGCM 的 AI 模型,可以更好的预测天气。 据悉,NeuralGCM 可以生成确定性天气、集合天气和气候预报,与最好的机器学习和基于物理的方法相当在一至十五天的预报中,NeuralGCM 可与欧洲中期天气预报中心的集合预测相媲美。在规定的海面温度下,NeuralGCM 可以准确跟踪几十年的气候指标,140 公里分辨率的气候预测显示了新出现的现象,如热带气旋的现实频率和轨迹。 NeuralGCM 模型是开源的,用户可以在笔记本电脑上相对快速地运行。
Luma AI 发布新功能 Loops,可生成循环视频 据 Luma AI 官方消息,旗下AI 产品Dream Machine 将增加新的功能 Loops。 新功能允许用户通过文本描述、图片和关键帧来创建无限循环的视频。该功能将会出现在文本栏中,用户只需要点击Loop 按钮,就可以创建循环视频,或对视频进行修改。 Dream Machine 是 Luma AI 在今年6月推出的视频编辑产品,可以利用 AI 技术进行各种复杂的视频修改和调整。不管是更换背景还是对人物和对象进行调整都可以通过文字轻松完成。
LensGo AI推FaceSync功能,融合表情、声音和图像 LensGo AI近日在X上宣布,推出全新功能 FaceSync,利用 AI 技术制作不同的视频。 据LensGo AI 表示,FaceSync 可以复制用户的表情和声音,并将其与选择的图片或者视频同步。用户可以录制自己的表演,然后挑选一张图片或视频,FaceSync将运用其先进的AI技术,将用户的面部表情、声音和口型与目标图像或视频完美融合。 FaceSync功能仍处于测试阶段,LensGo AI正在不断优化和调整,功能具体上线时间尚不确定。
深圳推出全国首个司法审判大模型 AI辅助法官提升审判效率 据深圳市中级人民法院消息,深圳市中级人民法院日前推出了一项创新性的人工智能辅助审判系统,这是全国首个在司法审判垂直领域实现"人工智能+审判"深度融合的大模型系统。 该系统由深圳中院自主研发,已在法庭上投入使用。在一起金融借款合同纠纷案件的审理中,审判长付璐奇就得到了这位AI"助理"的协助。这位电子助手能够进行案情分析,生成案件存疑问题,有效提升了办案效率。
三星将押注 AI 未来,正研发新款AI手机 据 Australian Financial Review 报道,三星移动体验部门总裁卢泰文透露,三星正在研发一款完全不同的 AI 手机。 据卢泰文表示,三星已经大部分研发资源都押注在 AI 方面,而这主要体现在两方面。一方面,三星将继续提升当前的 Galaxy AI 性能,让传统的 Galaxy 系列手机获得更强大的 AI 功能。另一方面,三星的研发团队还在研发一款拥有新形态的 AI 手机。 卢泰文并未透露新手机的具体细节,仅表示这款手机会更注重移动性。
努比亚推出自研星云大模型 号称编程性能国内排名第一 据努比亚官方消息,努比亚今天在新品发布会上正式推出了其自研的星云大模型,标志着公司在AI技术领域的重大突破。 在AI技术快速发展的当下,努比亚明确了其“AI+”产品战略,通过与专业AI研发团队的紧密合作,成功开发出星云大模型。该模型涵盖了自然语言处理和视觉识别等多个领域的高级AI能力,其性能在行业中处于领先地位。 星云大模型的研发基于努比亚自主研发的星环大模型,并进行了增量预训练。研发过程中,团队将丰富的领域数据、专业知识、大量通信技术文档以及1000亿token的无线和核心网代码语料整合进模型,利用并行训练框架进一步提升了模型的性能和适应性。

今日重点论文: 基因泰克: 《Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review》 本论文旨在探讨如何使用强化学习算法fine-tuning扩展扩散模型,以优化下游的奖励函数,实现生成最大化某些度量的样本。论文提出了基于强化学习算法的fine-tuning方法,包括PPO、可微优化、reward-weighted MLE、value-weighted sampling和path consistency learning等,用于优化扩散模型以生成最大化某些度量的样本。 论文地址: https://arxiv.org/abs/2407.13734v1 海德堡大学: 《Truth is Universal: Robust Detection of Lies in LLMs》 开发一种鲁棒的方法来检测LLM的谎言,解决LLM的谎言检测方法在泛化上的失败问题。发现了一个二维子空间,可以将真实和虚假陈述的激活向量分离,构建了一个准确的LLM谎言检测器。通过实验验证,该方法在简单真假陈述的检测上达到了94%的准确率,在复杂真实世界的谎言检测上达到了95%的准确率。 论文地址: https://arxiv.org/abs/2407.12831v1 三星: 《Any-Property-Conditional Molecule Generation with Self-Criticism using Spanning Trees》 本文旨在扩展基于生成树的图生成(STGG)方法,实现多属性条件分子生成,以解决在真实世界中需要根据一个或多个期望属性条件生成分子的问题。STGG+方法采用了现代Transformer架构、随机属性屏蔽、辅助属性预测损失等改进措施,使得生成的分子更加准确和有效。同时,该方法也可以自我批评分子的优劣,从而选择最佳的分子。 论文地址: https://arxiv.org/abs/2407.09357v2 香港大学: 《Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies》 本论文旨在探讨词汇量对于大型语言模型(LLMs)的影响,并提出预测计算最优词汇量的三种方法。本文的关键思路是通过三种方法预测计算最优词汇量,并验证了采用预测的最优词汇量可以提高下游任务的性能。论文通过训练不同词汇配置的33M到3B参数的模型,研究了词汇量对LLM扩展规律的影响。实验结果表明,最优词汇量取决于可用的计算预算,而大型模型需要更大的词汇量。作者的预测显示,大多数LLMs使用的词汇量过小。作者验证了采用预测的最优词汇量可以提高下游任务的性能。本文的亮点包括三种预测最优词汇量的方法、实验结果的验证以及下游任务性能的提升。本文使用了多个数据集,但没有开源代码。作者建议未来的研究应该考虑同时考虑模型参数和词汇量的影响。 论文地址: https://arxiv.org/abs/2407.13623v1