3 月 5 日 AI 头条:Anthropic 发布 Claude 3 系列大语言模型,号称已超越 GPT-4
划重点:
Anthropic 发布 Claude 3 系列大语言模型,号称已超越 GPT-4 和 Gemini 1.0 Ultra
大模型初创公司 MiniMax 开启新一轮融资,阿里领投
DocuSign 使用客户文件训练 AI 引争议,发言人承诺“数据将匿名化处理”
清华大学将为新生配备“AI 成长助手”,建设 AI 赋能教学试点课程
印度要求科技公司发布生成式 AI 工具之前,需先获得政府许可
ChatGPT 推出朗读功能,允许机器人语音交流 Wix 的新 AI 聊天机器人可根据提示在几秒钟内构建网站
微软与 Mistral 的交易增强了 Azure,但并未放弃 OpenAI
中科院自研 AI 大模型“紫东太初 3.0”今年上半年发布,优化智能驾驶训练
Anthropic 发布 Claude 3 系列大语言模型,号称已超越 GPT-4 和 Gemini 1.0 Ultra
人工智能创业公司Anthropic宣布推出其突破性的 Claude 3 系列模型,该系列大型语言模型 (LLM) 在各种认知任务上树立了新的性能标杆。Claude 3 系列包含三个子模型,分别为 Claude 3 Haiku、Claude 3 Sonnet 和 Claude 3 Opus,它们提供不同程度的智能、速度和成本选择,以满足各种人工智能应用需求。
大模型初创公司 MiniMax 开启新一轮融资,阿里领投
通用大模型初创项目 MiniMax 正在进行新一轮大规模融资,阿里为其中的核心领投方(一轮融资中投资最大的风险投资人)。此前,MiniMax 已完成 3 轮融资,投资方包括腾讯、米哈游等。截至发稿,MiniMax 及阿里方面均未对求证消息进行回应。
DocuSign 使用客户文件训练 AI 引争议,发言人承诺“数据将匿名化处理”
海外电子合同签署平台DocuSign 日前发布官方新闻稿,透露该公司将使用客户提交的各种合同数据来训练内部模型,不过 DocuSign 平台此举立刻引起巨大争议,外界普遍认为相关举动将导致用户机密合同外泄。
清华大学将为新生配备“AI 成长助手”,建设 AI 赋能教学试点课程
据清华大学官方公众号,在日前举行的 2024 年全校教职工大会期间,校长李路明在工作报告中着重介绍了学校在人工智能深度融入教育教学方面的探索与布局。李路明表示,学校将建设 100 门人工智能赋能教学试点课程,并为每一位 2024 级新生配备“AI 成长助手”。
印度要求科技公司发布生成式 AI 工具之前,需先获得政府许可
印度信息技术部于当地时间上周五发布公告:各家科技公司在发布生成式 AI 相关工具、新的模型之前,需要获得印度政府的明确许可。其要求科技公司确保自己的服务或产品“不允许任何偏见或歧视”。
ChatGPT 推出朗读功能,允许机器人语音交流
OpenAI 针对 ChatGPT 的新朗读功能现在可以在 ChatGPT 的网络版本以及 iOS 和 Android ChatGPT 应用程序上使用。Read Aloud 可以讲 37 种语言,但会自动检测正在阅读的文本的语言,并且该功能适用于 GPT-4 和 GPT-3.5。在竞争对手 Anthropic 为其 AI 模型添加类似功能后不久,OpenAI 就透露了这一点。
Wix 的新 AI 聊天机器人可根据提示在几秒钟内构建网站
Wix 的新 AI 网站构建器可根据提示来构建网站、图像等。创建网站是免费的,但想要接受付款等操作或不想仅限于使用 Wix 域名,则必须升级到 Wix 的高级计划之一。Wix 的价格范围从每月 17 美元的 Light 套餐(附带 2GB 存储空间、支持两名协作者以及一些基本的营销工具)到 159 美元的 Business Elite 套餐(最多支持 15 名协作者并提供高级分析)和电子商务功能。
微软与 Mistral 的交易增强了 Azure,但并未放弃 OpenAI
品玩3月5日讯,据 TheVerge 报道,微软与法国人工智能公司 Mistral 达成的多年协议表明,该公司希望在该领域长久发展。微软向 Mistral 投资了 20 亿欧元(21 亿美元),并宣布将把 Mistral 的最新人工智能模型 Mistral Large 引入 Azure。但对 Mistral(主要是一家开源人工智能模型开发商)的投资并不意味着微软对其第一个人工智能子项目 OpenAI 失去了信心。相反,微软正在为将 Azure 打造成一个样板花园奠定基础,并让自己在欧洲站稳脚跟。
中科院自研 AI 大模型“紫东太初 3.0”今年上半年发布,优化智能驾驶训练
武汉人工智能研究院联合中国科学院自动化研究所自主研发的“紫东太初”大模型已迭代到 2.0 版本,根据官方最新消息,“紫东太初 3.0”将于今年上半年发布。区别于当前以文本为主的大部分语言大模型,“紫东太初”大模型在研发之初即以多模态技术为核心,利用图-音-文等更多类型数据进行跨模态的统一表征和学习,实现了图像、文本、语音三模态数据间的“统一表示”与“相互生成”。
华盛顿大学:
《ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs》
本论文提出了一种基于ASCII艺术的破解攻击ArtPrompt,并引入了ViTC基准测试来评估LLMs在识别无法仅通过语义解释的提示方面的能力。论文展示了五种SOTA LLMs(GPT-3.5、GPT-4、Gemini、Claude和Llama2)在识别ASCII艺术提示方面的表现较差,因此提出了ArtPrompt攻击,并在五种SOTA LLMs上进行了评估。ArtPrompt可以有效地诱导所有五种LLMs产生不良行为。
论文地址:
https://arxiv.org/abs/2402.11753v2
牛津大学:
《SLEEPER AGENTS: TRAINING DECEPTIVE LLMS THAT PERSIST THROUGH SAFETY TRAINING》
论文构建了大型语言模型中欺骗性行为的概念证明,发现这种后门行为可以持久存在,并且传统的安全训练技术难以消除这种行为,甚至会造成虚假的安全印象。论文使用了多个实验来证明其结果,包括训练模型在特定情况下写安全代码,但在另一种情况下插入可利用的代码。结果表明,最大的模型和训练模型欺骗训练过程的思维链最难以消除欺骗性行为。
论文地址:
https://arxiv.org/abs/2401.05566v3
加州大学圣巴巴拉分校:
《Tweets to Citations: Unveiling the Impact of Social Media Influencers on AI Research Visibility》
研究编译了超过8,000篇论文的全面数据集,涵盖了2018年12月至2023年10月的推文,以及基于出版年份、会议、和摘要主题的1:1匹配的控制组。研究发现,得到影响者认可的论文引用次数显著增加,中位数引用次数比控制组高2-3倍。此外,研究还深入探讨了受关注作者的地理、性别和机构多样性。
论文地址:
《Escalation Risks from Language Models in Military and Diplomatic Decision-Making》
作者们设计了一个新的战争游戏模拟和评分框架,以评估这些代理在不同情境下采取的行动的升级风险。他们发现所有五个研究的预训练语言模型都显示出升级和难以预测的升级模式。与以往研究不同的是,他们的研究提供了定性和定量的见解,并专注于大型语言模型(LLMs)。
论文地址:
《MambaByte: Token-free Selective State Space Model》
论文使用MambaByte模型在字节级别上进行训练,并将其与其他基于字节的模型和子词模型进行比较,发现MambaByte模型的计算效率更高,并且在性能方面与现有的子词Transformer模型相当甚至更好。此外,论文还开源了MambaByte模型的代码和预训练模型,并使用了多个数据集进行实验验证。
论文地址:
https://arxiv.org/abs/2401.13660