GenAI新世界

8月19日 AI 头条|OpenAI 关闭 SearchGPT 候补名单,针对 10000 名用户开始测试

Image

划重点:

  • OpenAI 关闭 SearchGPT 候补名单,针对 10000 名用户开始测试
  • 昆仑万维发布 AI 短剧平台 SkyReels
  • 英伟达联手Meta,推出 Llama-3.1-Minitron 4B AI 模型
  • Exists 发布生成式 AI 应用,帮助开发3D游戏
  • 零一万物与顺丰科技达成生态合作,加速模应一体探索
  • 星火语音大模型将更新,推出拟人交互功能
  • 印度首款 AI 芯片计划 2026 年推出,将采用 ARM 架构

资讯详情:

OpenAI 关闭 SearchGPT 候补名单,针对 10000 名用户开始测试

据 The Verge 报道,OpenAI 宣布其新产品 SearchGPT 的候选名单已经关闭,并开始用户测试。

在初始阶段,只有 10000 名用户将被授予访问权限,这可能有助于避免搜索机器人提供错误建议的情况。

SearchGPT 可以让用户用自然语言提问,并获得详细、易懂的答案,就像在与专家交谈一样。系统能够保持对话的上下文,理解复杂的查询,甚至自己澄清细节。

Image

昆仑万维发布 AI 短剧平台 SkyReels

据昆仑万维集团官方消息,全球首个集成视频大模型与 3D 大模型的 AI 短剧平台 SkyReels 今天正式发布。

SkyReels 平台集剧本生成、角色定制、分镜、剧情、对白 / BGM 及影片合成于一体,创作者能够“一键成剧”,用户输入一个简单创意,该工具即可完成从剧本到成品短剧制作的全流程。SkyReels 可通过 AI 一键生成完整剧本、分镜、人物对白与 BGM,支持角色形象、音色与分镜的自定义调整,并能够自动将内容转换为 1080P 60 帧的高清视频,单次可生成视频长度达 180 秒。

该平台集成了昆仑万维自研剧本大模型 SkyScript、自研分镜大模型 StoryboardGen、自研3D 生成大模型 Sky3DGen、以及业界首个将 AI 3D 引擎与视频大模型深度融合的创新平台 WorldEngine。

Image

英伟达联手Meta,推出 Llama-3.1-Minitron 4B AI 模型

英伟达近日宣布,联手Meta 推出了一款Llama-3.1-Minitron 4B AI 模型,这是一款 只有40亿参数的小模型。

据悉这款模型是通过对英伟达Nemotron 系列中较大的 15B 兄弟姐妹进行剪枝和蒸馏而获得的。剪枝和蒸馏可带来多种好处:与从头开始训练相比,MMLU 分数提高了 16%。每个额外模型所需的训练标记更少,约为 1 亿个标记,最多可减少 40 倍。与从头开始训练所有模型相比,训练一系列模型的计算成本最多可节省 1.8 倍。

研究显示,蒸馏和剪枝之后的模型性能可与在更多代币上训练的 Mistral 7B、Gemma 7B 和 Llama-3 8B 相媲美,最多可达 15T Token。

Image

Exists 发布生成式 AI 应用,帮助开发3D游戏

AI 初创公司 Exists宣布推出一款生成式 AI 平台,任何人都可以通过简单的文本提示,在几分钟内开发出高质量的3D电脑游戏,而且不需要任何编码技能。

这一全自动流程在 Exists 的云创作平台上运行。在该初创公司专有的生成人工智能模型的支持下,用户可以使用直观的云生态系统创建可用于游戏的环境、角色、游戏机制等。

该平台的用户友好界面消除了传统的技术障碍,使游戏开发变得像输入概念一样简单。Exists 平台的核心是一个新颖的神经网络架构,它将生成式人工智能的突破与先进的游戏引擎功能融为一体。这使得该平台能够将人工智能驱动内容的创造潜力与现代游戏引擎的性能结合起来,从而使用户能够以最小的投入创造出视觉上震撼、机械上复杂的游戏。Exists 目前处于封闭测试阶段,邀请用户注册以获得早期访问权。

Image

零一万物与顺丰科技达成生态合作,加速模应一体探索

据零一万物官方消息,零一万物正式宣布与顺丰科技达成生态合作,双方将共同探索人工智能与供应链管理的深度融合,共同推动供应链管理智能化发展。

此次合作,结合了零一万物在大模型领域的技术沉淀以及顺丰科技对智慧供应链领域的深入理解,不仅将助力顺丰科技在供应链领域取得新进展,也使得零一万物 Yi 系列大模型在更广泛的商业场景中得到应用。

零一万物 CEO 李开复博士表示,“我们很高兴Yi API 受到了包含顺丰科技在内的头部客户的认可。AI 2.0将像电力一样穿透各行各业,像顺丰科技这样,主动拥抱 AI 2.0 技术的头部企业正变得越来越多。在极大提升自身生产力和竞争力的同时,它们将带领整个行业创造更巨大的价值。零一万物会持续为客户提供更简单易用、更安全稳定、更深度契合自身业务场景的技术解决方案,与合作伙伴一同‘Make AI Work’。”

Image

星火语音大模型将更新,推出拟人交互功能

据科大讯飞官方消息,科大讯飞即将对星火语音大模型进行更新,增加星火极速超拟人交互功能,该功能预计会在8月30日上线。

星火极速超拟人交互功能采用统一神经网络实现语音到语音的端到端建模。官方称即便被频繁打断,也能迅速反应,更加符合日常对话情境。升级后的版本可以针对高兴、悲伤、生气、害怕等情绪进行识别;自动带入符合情境的对话,用合适的情绪语气进行回复。

星火极速超拟人交互功能能够模仿包括孙悟空、蜡笔小新、小猪佩奇等多种角色的音色、语气,还会模仿他们的人设与用户聊天。

Image

印度首款 AI 芯片计划 2026 年推出,将采用 ARM 架构

据 Wccftech 报道,印度 Ola 电动汽车公司将于 2026 年推出该国首款自研 AI 芯片,采用 ARM 架构。

Ola 声称这项特殊的技术是为大规模 LLM 设计的,旨在迎合 AI 细分市场的大部分需求,这款芯片预计将于 2026 年投放市场。

Ola 还公布了名为 Bodhi-2 的下一代产品,它是一款相对更强大的 AI 芯片,可在 AI 工作负载中提供更高端的性能,预计 2028 年推出。

Image

今日重点论文:

特拉维夫大学:

《DifuzCam: Replacing Camera Lens with a Mask and a Diffusion Model》

本论文旨在解决平板无镜头相机重建图像质量不佳的问题,并提出了一种利用预训练扩散模型的重建方法。本论文的关键思路是利用预训练扩散模型结合控制网络和可学习可分离变换进行重建,从而实现高质量的图像重建。

论文地址:

https://arxiv.org/abs/2408.07541v1

斯坦福大学:

《Mission: Impossible Language Models》

论文旨在验证大型语言模型(LLMs)是否能够学习人类无法学习的语言,以及这些模型的学习能力是否与人类相同。通过开发一组人工合成的不可能语言,系统地改变英语数据的单词顺序和语法规则,对GPT-2小型模型进行评估,发现相对于英语控制组,GPT-2在学习不可能语言时表现较差,挑战了LLMs能够与人类相同的核心主张。

论文地址:

https://arxiv.org/abs/2401.06416v1

谷歌:

《Diffusion Augmented Agents: A Framework for Efficient Exploration and Transfer Learning》

DAAG旨在提高强化学习中具身体代理的样本效率和迁移学习能力。使用大型语言模型、视觉语言模型和扩散模型,通过后见之明经验增强技术,利用扩散模型将代理的过去经验重新标记,来自动地将其与目标指令对齐,从而降低强化学习中需要的奖励标记数据量,提高学习效率。

论文地址:

https://arxiv.org/abs/2407.20798v1

西北大学:

《Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities》

论文旨在综述模型合并方法及其应用,并提出一种新的分类方法,填补了该领域文献中的空白。论文提出了一种新的分类方法,对现有的模型合并方法进行了全面的讨论,并探讨了这些方法在不同领域和场景中的应用。论文探讨了模型合并方法在大型语言模型、多模态大型语言模型以及多个机器学习子领域中的应用,同时提出了模型合并面临的挑战和未来研究方向。论文作者还提供了一个包含模型合并论文的列表和开源代码的Github链接。论文地址:

https://arxiv.org/abs/2408.07666v2

Image