GenAI新世界

3 月 11 日 AI 头条:马斯克宣布本周将开源 Grok

Image

划重点:
  • 继起诉 OpenAI 并要求对方恢复开源后,马斯克宣布本周 xAI 将开源 Grok
  • 谷歌确认 Gemini Nano 本地大模型不会上线 Pixel 8 手机
  • Patronus 推出检测工具 CopyrightCatcher,可检测 AI 模型中“版权内容”
  • OpenAI 将参与外部供应商设计流程,以获符合需求 AI 硬件
  • Inflection-2.5 模型公布,全面提升聊天机器人 Pi 智商、情商
  • 70 亿参数,联发科推出 MR Breeze-7B 模型:擅长洞察数据、支持双语互动
  • 微软 Microsoft Designer 屏蔽特定提示词,避免 Copilot 生成不良价值导向图片
  • Pika发布全新功能,可为视频生成音效

资讯详情:

继起诉 OpenAI 并要求对方恢复开源后,马斯克宣布本周 xAI 将开源 Grok

马斯克今日下午通过 X 平台宣布,自家人工智能公司 xAI 将在本周内开源人工智能助手 Grok。随后,马斯克在回应网友“OpenAI 也应当如此,如果它们要像名字中的‘Open’那样”的帖子时表示,“OpenAI 就是谎言。”

此次马斯克宣布开源自家的 Grok,似乎想要“身体力行”敦促 OpenAI 恢复开源。马斯克曾在诉状中称,“OpenAI Inc. 已经转变成了全球最大科技公司微软的“事实上的”闭源子公司。在其新的董事会的领导下,它不仅仅是在开发,而且实际上正在完善一种通用人工智能(AGI),以最大化微软的利润,而不是为了造福人类。”

Image


谷歌确认 Gemini Nano 本地大模型不会上线 Pixel 8 手机

谷歌官方表示,由于硬件限制,AI 语言大模型 Gemini Nano 不会上线谷歌 Pixel 8 手机,但未来会出现在其他高端设备上。

Gemini Nano 作为谷歌为移动设备推出的 Gemini 大模型版本,能够处理不需要连接外部服务器的本地任务,仅支持谷歌 Pixel 8 Pro 手机。而今天,谷歌公司的相关人员在 YouTube 的一档节目中表示:由于一些硬件限制,Gemini Nano 不会出现在谷歌 Pixel 8 手机上。

Image


Patronus 推出检测工具 CopyrightCatcher ,可检测 AI 模型中“版权内容”

专门开发大语言模型(LLM)评估工具的Patronus AI 日前发布了一款名为“CopyrightCatcher”的 API,可用来检测大语言模型的输出结果中是否含有侵权内容,目前相关工具 DEMO 已经放出。

Patronus AI表示,市面上常见的大语言模型的训练数据中经常含有受到版权保护的内容,因此这些模型很容易输出相应版权内容,从而为部署相关模型的企业带来重大法律风险,因此他们推出了 CopyrightCatcher API,旨在解决相关侵权问题。

Image


OpenAI 将参与外部供应商设计流程,以获符合需求 AI 硬件

据 Data Centre Dynamics 报道,OpenAI 正招募软硬件协同设计工程师,帮助外部供应商设计符合 OpenAI 自身需求的 AI 硬件。

OpenAI 官网页面显示,该职位位于美国加州旧金山,将与其硬件工程师团队一同工作。OpenAI 对应聘者要求其对 GPU 等 AI 加速器及相关编程语言有良好经验,并具有使用低精度格式提高机器学习准确性的经历。在招聘页面中,OpenAI 特别提到,对于在最大化 HBM 带宽、优化低算术强度、优化内存层次结构等面感到兴奋的人士,这一岗位是绝佳机会。

Image



Patronus 推出检测工具 CopyrightCatcher ,可检测 AI 模型中“版权内容”

专门开发大语言模型(LLM)评估工具的Patronus AI 日前发布了一款名为“CopyrightCatcher”的 API,可用来检测大语言模型的输出结果中是否含有侵权内容,目前相关工具 DEMO 已经放出。

Patronus AI表示,市面上常见的大语言模型的训练数据中经常含有受到版权保护的内容,因此这些模型很容易输出相应版权内容,从而为部署相关模型的企业带来重大法律风险,因此他们推出了 CopyrightCatcher API,旨在解决相关侵权问题。

Image


Inflection-2.5 模型公布,全面提升聊天机器人 Pi 智商、情商

Inflection AI上周发布公告,正式发布了 Inflection-2.5 大语言模型,让 Pi 聊天机器人更聪明,也更富有同情心。

Pi 是一款面向个人涉及的人工智能应用程序,可在多种平台上使用。Pi 以注重同理心和安全性而闻名,而最新基于的 Inflection-2.5 大语言模型大幅提高了智商,可以媲美 GPT-4。

Image

70 亿参数,联发科推出 MR Breeze-7B 模型:擅长洞察数据、支持双语互动

联发科旗下研究机构联发科技研究中心(MediaTek Research)近日发布公告,展示推出了名为 MR Breeze-7B 的全新开源大语言模型(LLM)。

这款开源模型擅长处理繁体中文和英文,共有 70 亿个参数,以广受赞誉的 Mistral 模型为基础进行设计。与上一代产品 BLOOM-3B 相比,MR Breeze-7B 所吸收的知识显著增加了 20 倍,让其能以更高的精确度驾驭繁体中文中错综复杂的语言和文化细微差别。

Image



微软 Microsoft Designer 屏蔽特定提示词,避免 Copilot 生成不良价值导向图片

据 CNBC 报道,Microsoft Designer 在遇到一些特定的提示词时,例如“pro-choice”“four twenty” “pro-life”等,会生成一些涉及色情、暴力方面的不良图片,目前这些特定的提示词已经被微软禁用。(pro life 与 pro choice 是伴随堕胎合法权而产生的一组词,可以理解为“尊重生命”和“尊重选择”;而 four twent 420则是大麻文化中的俚语,用来指代吸食大麻或哈希什。)

Image



Pika发布全新功能,可为视频生成音效

文生视频平台 Pika 昨日凌晨通过 X 平台官宣新功能:视频可以集成 AI 生成的音效了。用户现可在 Pika 生成的视频中无缝生成、整合声音,可以通过提示词来描述想要的声音,或者直接让 Pika 根据视频内容自动生成声音。“如果您觉得它很酷,那是因为它的确很酷。抱歉,我们之前静音了!”

Image

今日重点论文:

加州理工学院:

《Learning shallow quantum circuits》
本文提出了一种基于局部反演的量子电路表示方法,并利用这种方法来构建量子电路的优化模型。这种方法可以有效地学习到经典难以模拟的量子电路。本文提出的算法可以在多项式时间内学习到未知的浅层量子电路的描述,这是一个新的结果。此外,本文使用了基于局部反演的量子电路表示方法,这种方法可以有效地优化量子电路,使得学习更加高效。
论文地址:
https://arxiv.org/abs/2401.10095v1

加州大学伯克利分校:

《Approaching Human-Level Forecasting with Language Models》

论文开发了一种检索增强的语言模型系统,用于自动搜索相关信息、生成预测并聚合预测结果,通过大量竞争性预测平台的问题数据集进行测试,结果表明该系统的预测准确性接近或超过人类预测者的聚合结果。

论文地址:

https://arxiv.org/abs/2402.18563v1


谷歌:
《Gemini: A Family of Highly Capable Multimodal Models》

Gemini模型在跨模态推理和语言理解方面具有出色的性能,可以应用于各种应用场景。实验设计充分,使用了20个多模态基准测试数据集,并在30个基准测试中取得了优异的成绩。论文还讨论了如何负责任地将Gemini模型部署到用户身上。

Gemini模型在跨模态推理和语言理解方面具有出色的性能,可以应用于各种应用场景。实验设计充分,使用了20个多模态基准测试数据集,并在30个基准测试中取得了优异的成绩。论文还讨论了如何负责任地将Gemini模型部署到用户身上。

论文地址:

https://arxiv.org/abs/2312.11805v1


纽约大学:

《NON-VACUOUS GENERALIZATION BOUNDS FOR LARGE LANGUAGE MODELS》

论文提出一种压缩界限方法SubLoRA,使用预测平滑来处理无界对数似然损失,同时扩展该界限以处理子采样。研究表明,LLMs能够发现适用于未见过数据的规律,同时提出的SubLoRA方法可以使模型更易于压缩,从而获得更好的泛化界限。

论文地址:

https://arxiv.org/abs/2312.17173v1


乔治亚理工学院:

《Escalation Risks from Language Models in Military and Diplomatic Decision-Making》

作者们设计了一个新的战争游戏模拟和评分框架,以评估这些代理在不同情境下采取的行动的升级风险。他们发现所有五个研究的预训练语言模型都显示出升级和难以预测的升级模式。与以往研究不同的是,他们的研究提供了定性和定量的见解,并专注于大型语言模型(LLMs)。

论文地址:

https://arxiv.org/abs/2401.03408v1

Image