GenAI新世界

7月1日 AI 头条 | 马斯克表示 xAI 将会在今年8月份发布 Grok-2 大语言模型

Image
划重点:
  • 马斯克表示 xAI 将会在今年8月份发布 Grok-2 大语言模型
  • 微软将会在7月份推出 Microsoft 365 Copilot 功能更新
  • 苹果或将会在今年秋季公布与谷歌Gemini 合作事宜
  • OpenAI聘请Zapier原首席营收官担任销售战略负责人
  • 知乎发布全新AI产品知乎直答
  • Solos 推出新款智能眼镜 Solos AirGo Vision,支持Gpt-4o 模型
  • 微软与 OpenAI / 谷歌与三星之间的 AI 交易受到欧盟关注
  • Meta 宣布推出代码优化模型 LLM Compiler
  • 谷歌 AI 视频编辑应用 Google Vids 上线测试
资讯详情:
马斯克表示 xAI 将会在今年8月份发布 Grok-2 大语言模型
马斯克在自己的 X平台上发文宣布,其人工智能初创公司 xAI 的大语言模型 Grok-2 将于 8 月推出。
博主 Bef-e / acc 发文称,当前的模型在彼此的数据上进行训练,就像人体蜈蚣效应一样。马斯克在回复中表示,“很遗憾,情况确实就是这样。从互联网训练的数据中清除大语言模型需要花费大量工作。8 月即将推出的 Grok-2,在这方面将拥有巨大进步。”
Image
微软将会在7月份推出 Microsoft 365 Copilot 功能更新
据微软官方消息,微软将会在7月份对Microsoft 365 Copilot进行一次更新,增加更多的 AI 功能。
其中一项功能将允许用户访问 Word 和 PowerPoint 应用程序中的 Microsoft Designer AI 艺术创作者。此外它还将允许 SharePoint 用户利用 Copilot 重写新闻帖子和网站上的当前文本。
微软透露,他们已将 Copilot for Microsoft 365 的访问权限扩展到了一些软件独立用户计划中。
Image
苹果或将会在今年秋季公布与谷歌Gemini 合作事宜
据 Mark Gurman 表示,苹果或将会在今年秋季宣布和谷歌合作,将谷歌 Gemini 整合到其设备中。
此前有消息称,苹果将会和 Meta 合作,将其大模型引入苹果设备,但在考虑其安全性之后,放弃了和 Meta的合作计划。另外,Gurman 提到还有第三家候选公司,也就是OpenAI 的老对手Anthropic。
Image
OpenAI聘请Zapier原首席营收官担任销售战略负责人
据界面新闻报道,原Zapier首席营收官Giancarlo Lionetti已加入OpenAI,担任销售战略负责人。
据悉,Giancarlo Lionetti将帮助 OpenAI 扩展其企业软件业务。
Image
知乎发布全新AI产品知乎直答
据36氪获悉,6月29日,知乎第十届盐Club新知青年大会在京举行。在大会上,知乎创始人、董事长兼CEO周源在大会发表演讲,并发布知乎最新的AI产品“知乎直答”。
据介绍,该产品是AI搜索功能的正式产品化,同时拥有独立域名和服务入口,能为用户带来更优质的提问、搜索、结果生成和归纳体验。目前,该产品已上线PC端,通过“zhida.ai”域名即可使用。
Image
Solos 推出新款智能眼镜 Solos AirGo Vision,支持Gpt-4o 模型
据 The Verges 报道,发布新款智能眼镜 Solos AirGo Vision,这款智能眼镜将会在今年晚些时候发售。
据悉, Solos AirGo Vision 将采用 OpenAI 的新 GPT-4o AI 模型,让摄像头识别物体并根据所看到的东西回答用户的问题。Solos AirGo Vision 还包括与 Solos 其他眼镜相同的可更换镜框系统,让用户可以在不合适的场合将摄像头关掉。
Image
微软与 OpenAI / 谷歌与三星之间的 AI 交易受到欧盟关注
据 investopedia 报道,欧盟委员会周五表示,他们正在监督大型科技公司的人工智能合作关系及其对竞争的影响,并点名批评了微软和OpenAI,以及谷歌母公司Alphabet和三星。
欧盟表示,他们正在请求提供有关微软与 OpenAI 之间协议的信息,重点是两家公司之间的排他性。微软的Azure是OpenAI的独家云服务提供商,这是双方签订的为期多年、价值数十亿美元的协议的一部分。
Image
Meta 宣布推出代码优化模型 LLM Compiler
据 mspoweruser 报道,Meta 近期推出一款新的大语言模型 LLM Compiler,专门面向软件开发人员,是一款用于优化代码和编译器推理的模型。
据 Meta 表示, LLM Compiler 系列模型以 Meta Code Llama 为基础,可以模拟编译器、预测代码通过率并反汇编代码,效果惊人。所有模型都是在许可授权下推出的,可供开发人员和研究人员商业使用。
Image
谷歌 AI 视频编辑应用 Google Vids 上线测试
据 9to5Google 报道,谷歌近日宣布,其 AI 视频编辑应用Google Vids 现已开启测试,用户可以在 Workspace Labs 上试用。
Vids 是 Google Workspace 应用程序,与 Docs、Sheet 和 Slides 并列,并提供协作功能。用户可以通过提示词来创建视频,也可以添加上传到谷歌硬盘的任何文档。Vids 将生成一个故事板,用户可以通过重新排序和删除来编辑故事板,也可以添加自己的观点,还可以选择风格。视频将使用库存的视频、图片和背景音乐来进行合成。
Image
今日重点论文:
蒙纳士大学:
《Beyond Human Translation: Harnessing Multi-Agent Collaboration for Translating Ultra-Long Literary Texts》
如何通过多智能体框架和大型语言模型来解决文学翻译中的困难?使用TransAgents公司的多智能体框架,利用大型语言模型协同翻译文学作品,提高翻译质量。同时提出了两种新的评估策略,分别从单语读者和双语语言模型的角度评估翻译质量。实验结果表明,TransAgents的翻译质量在某些领域优于人工翻译,尤其是需要领域特定知识的文学作品。论文还提供了案例研究,并探讨了TransAgents的优点和局限性。
论文地址:
https://arxiv.org/abs/2405.11804v1
加利福尼亚大学洛杉矶分校:
《Adaptable Logical Control for Large Language Models》
论文旨在解决在生成过程中控制模型遵循逻辑约束这一持久性难题,提出了一种可适应的框架Ctrl-G,以实现可靠地遵循逻辑约束的LLM生成。Ctrl-G将任何可生产的LLM与隐马尔科夫模型结合,使LLM输出遵循表示为确定性有限状态自动机的逻辑约束。在交互式文本编辑和中等规模语言模型上的实验表明,Ctrl-G在受限生成方面的性能优于GPT3.5和GPT4,并且在标准基准测试中,Ctrl-G击败了其对手。
论文地址:
https://arxiv.org/abs/2406.13892v1
LAION :
《Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models》
论文试图验证当前最先进的大型语言模型在常识问题上的推理能力是否存在严重缺陷,以及当前的评估标准是否能够发现这种缺陷。通过一个简单的常识问题,揭示了当前最先进的大型语言模型在推理能力上的严重缺陷,并提出了需要建立新的标准化评估基准的观点。
论文地址:
https://arxiv.org/abs/2406.02061v2
哈佛大学:
《Newswire: A Large-Scale Structured Database of a Century of Historical News》
本文试图构建一个历史上美国新闻通讯的全面档案,以了解当时的国家认同和世界观,并通过自然语言处理技术进行实体消歧、主题分类和地理位置标记等处理。本文利用深度学习技术,对数百万份原始图像扫描进行处理,构建了包含270万份美国新闻通讯文章的数据集。文章中的位置、主题和命名实体等信息都被加以处理,同时使用自然语言处理技术进行实体消歧,以及使用自然语言处理技术进行主题分类。
论文地址:
https://arxiv.org/abs/2406.09490v1
Image