8月16日 AI 头条 | 谷歌开放 Imagen 3 文生图 AI 访问
划重点:
谷歌开放 Imagen 3 文生图 AI 访问 百度文库推出橙篇 APP,支持多项 AI 功能 微信、蚂蚁或将涉足AI应用商店 收到中国知网 28 页侵权告知函,秘塔称多家数据库主动合作、后续服务不受影响 Midjourney网页版更新:推全新图像编辑器 CodeRabbit获1600万美元融资,助力AI自动化代码审查 Runway发布Gen-3 Alpha Turbo:AI视频生成速度提升7倍
资讯详情:
谷歌开放 Imagen 3 文生图 AI 访问
据 VentureBeat 报道,谷歌已经向美国用户正式开放了最新文生图 AI 模型 Imagen 3 测试,方便用户体验。
在谷歌的人工和自动评估中,Imagen 3 的表现优于 Imagen 2、DALL-E 3、Midjourney v6、Stable Diffusion 3 和 Stable Diffusion XL 1.0,Imagen 3 在将文本描述与生成的图像相匹配以及处理详细提示方面表现尤为突出。
据悉,Imagen 3 能更准确地理解文字提示,并将其转化为图像,而且其生成的图像更具“创造性和细节”,且模型产生的干扰元素和错误也更少。
百度文库推出橙篇 APP,支持多项 AI 功能
百度文库近日宣布,在5月底发布的 AI 应用橙篇现已推出移动版,免费登录 Android 平台。
据悉,橙篇支持智能全网搜索、AI 今日热点等类似资讯类 App 的功能,还支持多图一键成片、超长文章写作、文件理解总结等生成式大模型功能。此外,该产品具备对话能力,支持发送文字、语音输入等进行自由对话。
今年 6 月,百度文库宣布,新产品“橙篇”行业首创 10 万字长文生成及多模态编辑能力,成为行业首个“查阅创编”一站式 AI 自由创作平台。
微信、蚂蚁或将涉足AI应用商店
据 Tech星球报道,微信的云开发团队正在打造一款名为“云开发AI智能体”的应用平台,这是一个多平台AI智能体开发框架,用于企业和小程序提供专属的智能体平台。
通过该平台,用户可以实现0代码开发,打造专属个性化智能助手产品。此外,蚂蚁集团也在开发一款AI应用搭建工具“芝士饼”。开发者为蚂蚁云通(上海)信息技术有限公司,天眼查显示,该公司由蚂蚁集团100%控股。用户通过该平台也能够在无代码的情况下搭建AI应用,支持创作成支付宝小程序等多重产品形态。
据报道,今年以来,AI智能体应用开发平台成为全球AI平台的新赛道。今年1月,OpenAI推出名为GPT Store的平台,它允许用户创建、发现和使用针对各种目的定制的GPT,进一步降低了AI智能体应用的开发和使用门槛,也标志着“AI应用商店”时代的到来。
收到中国知网 28 页侵权告知函,秘塔称多家数据库主动合作、后续服务不受影响
秘塔公司今天上午通过官方公众号发文称,昨天收到《中国学术期刊(光盘版)》电子杂志社有限公司(即“知网”)长达 28 页的侵权告知函。
秘塔方面今天下午表示,后续提供服务完全不受影响,已经有多家数据库主动表示愿意和秘塔合作。秘塔科技首席运营官王益为回应称,秘塔 AI 搜索的收录内容均为公开的摘要和题录,并无任何收录知网文章内容本身的行为。
他进一步表示,数据所有权属于知网,但是侵权前提是要有损害,其对“侵犯知网合法权益”指控表示困惑。
Midjourney网页版更新:推全新图像编辑器
据Midjourney官方消息,Midjourney现已更新全新版本,推出全新网络编辑器,整合多项图像操作,满足用户需求。
新版编辑器的亮点在于它巧妙地融合了局部重绘、图像比例调整以及提示词编辑等核心功能。这种整合不仅大大提高了操作效率,更使整体交互逻辑变得清晰明了。对于经常使用Midjourney的用户来说,这无疑是一个令人欣喜的重大改进。
这次更新体现了Midjourney在面对竞争时的应对策略:一方面持续改进核心的图像生成能力,另一方面也在努力优化用户体验。新版网络编辑器的推出,正是为了提供更加流畅、高效的创作环境,以吸引并留住用户。
CodeRabbit获1600万美元融资,助力AI自动化代码审查
据 Techcrunch 报道, CodeRabbit 宣布获得 1600 万美元的 A 轮融资,由 CRV 领投,Flex Capital 和 Engineering Capital 参投。
CodeRabbit是一家 AI 初创公司,其目标是通过人工智能来自动化代码审查过程。CodeRabbit 的平台利用先进的人工智能推理来理解代码背后的意图,并为开发者提供可操作的、类似人类的反馈。
新的现金将用于扩大 CodeRabbit 的 10 人销售和营销职能以及产品供应,重点是增强其安全漏洞分析能力。该平台还将在依赖性管理、代码重构、单元测试生成和文档生成方面引入先进的人工智能自动化。
Runway发布Gen-3 Alpha Turbo:AI视频生成速度提升7倍
据 Runway 官方消息,Runway 正式推出了 Gen-3Alpha Turbo,这是该公司最新的 AI 视频生成模型。
与此前发布的Gen-3 Alpha相比,Turbo生成速度可提高 7 倍,价格仅为原版 Gen-3 Alpha 的一半。同时在许多用例中仍具有同等性能。Turbo 适用于所有用户,包括免费用户的试用版。
今日重点论文:
Sakana AI:
《The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery》
论文旨在提出一种全自动的科学发现框架,使得前沿的大型语言模型能够独立进行研究并传达其发现。该框架的实现能够使得AI代理人像人类科学界一样,迭代地开发想法,从而在机器学习领域实现全自动科学发现。该框架引入了AI Scientist,能够生成新的研究思路,编写代码,执行实验,可视化结果,并编写完整的科学论文,然后运行模拟审核过程进行评估。这一过程可以重复进行,以开放式的方式迭代开发想法,从而像人类科学界一样。
论文地址:
https://arxiv.org/abs/2408.04948v1
Meta:
《Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations》
本文试图解决大规模推荐系统中深度学习推荐模型无法随计算能力扩展的问题,提出了一种新的架构HSTU,并将推荐问题重新表述为生成建模框架中的序列传导任务。本文提出的HSTU架构在高基数、非平稳流推荐数据上表现优异,比基线模型在综合和公共数据集上的NDCG指标提高了高达65.8%,而且在8192长度序列上比基于FlashAttention2的Transformer快5.3倍到15.2倍。基于HSTU的生成推荐器在在线A/B测试中提高了12.4%的度量,并已经部署在一个拥有数十亿用户的大型互联网平台的多个表面。
论文地址:
https://arxiv.org/abs/2402.17152v3
谷歌:
《Imagen 3》
该论文旨在介绍一种名为Imagen 3的潜在扩散模型,该模型可以从文本提示中生成高质量的图像。论文还试图探讨如何最小化模型可能造成的潜在伤害。该论文提出了一种新的潜在扩散模型,该模型可以生成高质量的图像。相比当前领域的研究,该论文的创新之处在于它可以从文本提示中生成图像,并且在质量和责任方面进行了全面的评估。
论文地址:
https://arxiv.org/abs/2408.07009v1
弗吉尼亚理工大学:
《How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs》
如何利用社交科学研究中的说服分类法来破解大型语言模型(LLMs)并探索日常语言互动和人工智能安全之间的交集。利用自动生成的可解释的说服性对抗提示(PAP)来破解LLMs,结果表明说服显著提高了破解性能,同时发现现有的防御机制存在显著缺陷。
论文地址:
https://arxiv.org/abs/2401.06373v2