GenAI新世界

7月19日 AI 头条|谷歌、OpenAI、微软等 AI 巨头成立安全 AI 联盟,促进 AI 安全发展

Image
划重点:
  • 谷歌、OpenAI、微软等 AI 巨头成立安全 AI 联盟,促进 AI 安全发展
  • OpenAI 发布 GPT-4o mini,用户可免费使用
  • Mistral 发布全新小模型 MIstral NeMo,与英伟达合作研发
  • 谷歌将利用 Gemini 为 奥运会转播提供技术支持
  • 微软 AI 设计应用 Designer 上架iOS 和 Android
  • Meta 宣布暂停在巴西训练其 AI 工具
  • 商汤绝影行业首发原生多模态大模型车端部署
  • 小米、王田苗、智源投资具身智能科技公司小雨智造
资讯详情:
谷歌、OpenAI、微软等 AI 巨头成立安全 AI 联盟,促进 AI 安全发展
据 The Verge 报道,谷歌、OpenAI、微软、亚马逊、英伟达、英特尔和其他人工智能领域的大公司周四宣布,将联合成立安全人工智能联盟(CoSAI)。
该倡议旨在通过提供开源方法、框架和工具,解决 "人工智能安全的碎片化 "问题。加入 CoSAI 的其他公司包括 IBM、PayPal、思科和 Anthropic。CoSAI 将隶属于结构化信息标准促进组织(OASIS),这是一个促进开放标准发展的非营利组织。   
CoSAI 将首先致力于实现三个目标:制定人工智能安全的最佳实践;应对人工智能领域的挑战;确保人工智能应用的安全。
Image
OpenAI 发布 GPT-4o mini,用户可免费使用
据 OpenAI 官方消息,OpenAI 今天正式发布小型模型GPT-4o mini。
据OpenAI 表示,GPT-4o mini 在 MMLU 上的得分为 82%,目前在 LMSYS 排行榜(在新窗口中打开)上的聊天偏好方面优于 GPT-41。它的价格为每百万输入代币 15 美分,每百万输出代币 60 美分,比以前的前沿模型便宜一个数量级,比 GPT-3.5 Turbo 便宜 60% 以上。
GPT-4o mini 以其低成本和低延迟实现了广泛的任务,如连锁或并行多个模型调用(如调用多个 API)、向模型传递大量上下文(如完整代码库或对话历史)或通过快速、实时文本回复与客户交互(如客户支持聊天机器人)的应用。   
目前,GPT-4o mini 的应用程序接口支持文本和视觉,未来还将支持文本、图像、视频和音频输入和输出。该模型的上下文窗口可容纳 128K 标记,每个请求最多支持 16K 输出标记,知识库可持续到 2023 年 10 月。
GPT-4o mini 现已作为文本和视觉模型提供给助手应用程序接口(Assistants API)、聊天完成应用程序接口(Chat Completions API)和批处理应用程序接口(Batch API)。在 ChatGPT 中,免费、Plus 和 Team 用户从今天开始将能访问 GPT-4o mini,以取代 GPT-3.5。
Image
Mistral 发布全新小模型 MIstral NeMo,与英伟达合作研发    
据 Mistral 官方消息,Mistral 近日推出旗下最新小型模型MIstral NeMo,由Mistral 和 英伟达合作开发。
Mistral NeMo 可提供高达 128k 标记的大型上下文窗口。它的推理能力、世界知识和编码准确性在同类产品中都是最先进的。由于 Mistral NeMo 依赖于标准架构,因此易于使用,可以直接替换任何使用 Mistral 7B 的系统。
Mistral NeMo 在训练时具有量化意识,可在不损失任何性能的情况下进行 FP8 推理。
Image
谷歌将利用 Gemini 为 奥运会转播提供技术支持
据 The Verge 报道,谷歌已经成为美国奥运代表队官方 AI 赞助商,从7月26日开始,谷歌将利用 Gemini为奥运赛事转播提供技术支持。
据悉,转播内容将包括谷歌地图对凡尔赛宫、罗兰-加洛斯球场和水上运动中心等场馆的 3D 全景,以及每个场馆将举办哪些活动的花絮。这些图像来自过去几年中添加到地图中的沉浸式视图,这些视图以逼真的模型表现了某些地标性建筑和感兴趣的区域。   
Image
微软 AI 设计应用 Designer 上架iOS 和 Android
据 The Verge 报道,微软宣布旗下, AI 设计应用 Designer 现已在 iOS 和 Android 平台上架。
Microsoft Designer 可让使用模板创建自定义图片、贴纸、贺卡、邀请函等。Designer 还可以使用人工智能来编辑图片、调整图片样式或创建图片拼贴。
该应用此前仅推出过网页版,即日起,该产品可以在Windows、iOS 和 Android 平台上免费使用。   
Image
Meta 宣布暂停在巴西训练其 AI 工具
据 TechCrunch 报道,由于受到巴西国家数据保护局的禁令,Meta 将暂停在巴西训练 AI 。
不久前,巴西国家数据保护局(ANPD)禁止Meta使用巴西人的个人数据训练其人工智能模型。如果违反规定,每天将被处以 50000 雷亚尔的罚款。Meta 表示,决定暂停之前在巴西上线的 genAI 功能,同时与 ANPD 进行接触,解决他们围绕 genAI 提出的问题。   
Image
商汤绝影行业首发原生多模态大模型车端部署
据商汤科技官方消息,基于原生多模态大模型,商汤绝影正在打造一系列全新的车载智能化产品,推动智能汽车向超级智能体进化。
商汤科技联合创始人、首席科学家、绝影智能汽车事业群总裁王晓刚宣布商汤绝影在行业内率先实现了原生多模态大模型的车端部署。绝影行业领先的车载端侧8B模型首包延迟可低至300毫秒以内,推理速度40 Tokens/秒,并且能够覆盖主流算力平台。
商汤绝影能够以云侧、端云结合、端侧等全栈方式灵活部署多模态大模型,让商汤原生多模态能力能够快速落地智能汽车。   
Image
小米、王田苗、智源投资具身智能科技公司小雨智造
据36氪报道,小米集团和机器人泰斗王田苗,投了一家具身智能科技公司“小雨智造”。
这家公司2023年2月成立,成立之后陆续完成了亿元种子轮融资,由小米集团、机器人泰斗王田苗、北京智源研究院出资。这也是小米对外投资的第一家具身智能领域公司。
小雨智造创始人乔忠良是小米的初创成员之一,曾经是MIUI研发负责人,负责过MIUI 9到MIUI 12等产品,于2023年1月从小米离职。小雨智造主要打造“一脑多形”的具身智能机器人。   
Image
今日重点论文:
ARC:
《Reactor Mk.1 performances: MMLU, HumanEval and BBH test results》
本文介绍了Reacto Mk.1的性能结果,并强调其在效率和效能方面的优势。Reacto Mk.1在MMLU数据集上获得了92%的得分,在HumanEval数据集上获得了91%的得分,在BBH数据集上获得了88%的得分。该模型在处理复杂任务和推理方面表现出色。此外,本文还介绍了使用的Lychee AI引擎以及模型的参数数量少于1000亿,使其成为当前领先的人工智能解决方案之一。
论文地址:
https://arxiv.org/abs/2406.10515v1
谷歌:
《Foundational Autoraters: Taming Large Language Models for Better Automatic Evaluation》
FLAMe试图解决如何更好地评估大型语言模型输出的问题,以及如何提高评估的效率和准确性。FLAMe是一种基于100多个质量评估任务的大规模评估模型,通过使用公开发布的人类评估数据进行训练,提高了对各种任务的泛化能力,并在许多任务上优于GPT-4等专有数据训练的大型语言模型。   
论文地址:
https://arxiv.org/abs/2407.10817v1
加州大学伯克利分校:
《Genomic Language Models: Opportunities and Challenges》
Genomic Language Models (gLMs)的开发和应用面临哪些挑战?gLMs可以在基因组学中应用于健康预测、序列设计和迁移学习等方面,但是开发高效的gLMs仍然存在挑战。论文介绍了gLMs的应用,包括健康预测、序列设计和迁移学习,并探讨了开发和评估gLMs时需要考虑的问题。
论文地址:
https://arxiv.org/abs/2407.11435v1
LG:
《Click-Gaussian: Interactive Segmentation to Any 3D Gaussians》
本文旨在解决3D高斯分割的实时操作问题,同时提供更详细的分割结果,避免后处理的时间浪费,这是否是一个新问题?文章提出了Click-Gaussian方法,通过学习两个层次的可区分特征场,实现了更快速的分割,同时使用全局特征引导学习来解决2D分割结果不一致的问题。
论文地址:
https://arxiv.org/abs/2407.11793v1    
Image