GenAI新世界

7月5日 AI 头条|法国 AI 初创团队 Kyutai 推出多模态大模型模型 Mosh

Image
划重点:
  • 法国 AI 初创团队 Kyutai 推出多模态大模型模型 Mosh
  • 百度李彦宏:AI 只是辅助,不会替代人的工作
  • 三星放缓汽车半导体开发,专注于人工智能芯片
  • 孙正义计划筹集 100 亿美元,用于 AI 领域投资
  • 商汤发布国内首个所见即所得模型日日新 5o
    向开发者免费开放文心大模型 4.0,百度文心智能体升级
  • 无问芯穹发布全球首个单任务千卡异构芯片混合训练平台
  • 《人工智能全球治理上海宣言》发布
  • 商汤发布首个可控人物视频生成大模型 Vimi
  • 阶跃星辰发布三款Step系列通用大模型新品
资讯详情:
法国 AI 初创团队 Kyutai 推出多模态大模型模型 Mosh
据 Dataconomy 报道,来自法国的初创团队 Kyutai 近日推出了多模态大模型模型 Moshi。
据悉,Moshi 的功能和 OpenAI 的 Gpt-4o 类似,可以通过语音和用户交互。Moshi适用多种情绪和风格与用户交流,还可以识别英文、法语等多种语言。
目前Moshi 已经开始免费测试,预计会在未来几周内发布。
Image
百度李彦宏:AI 只是辅助,不会替代人的工作
在7月4日的2024 世界人工智能大会暨人工智能全球治理高级别会议上,百度 CEO 李彦宏出席并发表演讲。
李彦宏指出,AI 正在以前所未有的速度向各行各业渗透,很多人担心 AI 抢走人类工作机会,但他强调,AI更多是在扮演副驾驶的角色,背后还是需要人类来把关,AI 可以提升人的工作效率和工作质量。李彦宏也表示,随着 AI 技术发展,一些新的工作机会也开始出现,比如数据标注师、提示词工程师等等,这些职位门槛并不高。
Image
三星放缓汽车半导体开发,专注于人工智能芯片
据BusinessKorea报道,作为战略调整的一部分,三星电子正在调整其汽车半导体的开发速度,以专注于人工智能芯片。
消息称,三星负责芯片设计的系统LSI部门近日进行了业务和组织重组,以优先发展人工智能芯片。这次重组导致下一代汽车处理器“Exynos Auto”被重新考虑。负责该芯片开发的人员已被重新分配到人工智能系统芯片团队,该团队目前是三星设计工作的重点。目前,100至150名专业设计人员集中在该部门进行人工智能芯片设计。
Image
孙正义计划筹集 100 亿美元,用于 AI 领域投资
根据 The Information 报道,软银首席执行官孙正义近日表示,希望将软银打造成为 AI 领域的领导者。
据悉软银已经接触了多家银行,磋商融资开展 AI 能源相关项目,据悉项目计划总投资 100 亿美元,项目涉及 AI 时代的能源供应、大量采用英伟达 AI 加速卡等等。
Image
商汤发布国内首个所见即所得模型日日新 5o
商汤科技官方消息,商汤科技发布“日日新 SenseNova 5.5”大模型体系,并发布国内首个所见即所得模型“日日新 5o”,交互效果对标 GPT-4o。
通过整合跨模态信息,基于声音、文本、图像和视频等多种形式,“日日新 5o”带来全新的 AI 交互模式 —— 实时的流式多模态交互。据介绍,“日日新 5o”能听、会看、更会找话题,就如同“真人聊天一般”,这种交互模式适用于实时对话和语音识别等应用,能够在同一模型中自然处理多种任务,且根据不同上下文自适应调整行为和输出。
日日新 5.5 是国内首个正式发布的流式原生多模态交互模型,模型训练基于超过10TB tokens 高质量训练数据,包括大量高质量的人工合成数据,构建了高阶思维链。模型采用混合端云协同架构,拥有6000 亿参数,可最大限度发挥云边端协同,达到109.5 字 / 秒的推理速度。
Image
向开发者免费开放文心大模型 4.0,百度文心智能体升级
据百度官方消息,百度文心智能体平台免费开放了文心大模型 4.0。开发者在文心智能体平台上制作智能体时,可灵活选择文心大模型 3.5 或 4.0 版本。
据介绍,文心智能体平台 AgentBuilder,是基于文心大模型的智能体构建平台,为开发者提供低成本的开发方式,支持根据自身行业领域、应用场景,打造大模型时代的原生应用。据悉,目前已经有 20 万开发者、6.3 万企业加入百度文心智能体平台。在 7 月 4 日举办的 2024 年世界人工智能大会上,百度创始人、董事长兼首席执行官李彦宏表示,智能体是最看好的 AI 应用方向,而搜索是智能体分发的最大入口。
Image
无问芯穹发布全球首个单任务千卡异构芯片混合训练平台
据无问苍穹联合创始人兼 CEO 夏立雪 表示,无问苍穹现已发布无问芯穹大规模模型的异构分布式混合训练系统,称千卡异构混合训练集群算力利用率最高达到了 97.6%。
夏立雪还宣布无问芯穹 Infini-AI 云平台已集成大模型异构千卡混训能力,是全球首个可进行单任务千卡规模异构芯片混合训练的平台,具备万卡扩展性,支持包括 AMD、华为昇腾、天数智芯、沐曦、摩尔线程、英伟达六种异构芯片在内的大模型混合训练。
Image
《人工智能全球治理上海宣言》发布
据新华社报道,2024 世界人工智能大会暨人工智能全球治理高级别会议发表《人工智能全球治理上海宣言》
《宣言》提到,倡导开放与共享的精神,推动全球人工智能研究资源的交流与合作。建立合作平台,促进技术转移与成果转化,推动人工智能基础设施公平分配,避免技术壁垒,共同提升全球人工智能的发展水平。
Image
商汤发布首个可控人物视频生成大模型 Vimi
据商汤科技官方消息,商汤在世界人工智能大会上发布了收款可控任务视频生成模型 Vimi。
Vimi 可以通过一张人像照片来生成人物类视频,并让视频中的角色做出不同的表情。商汤称 Vimi 不但可以实现精准的人物表情控制,还可实现在半身区域内控制照片中人物的自然肢体变化,并自动生成与人物相符的头发、服饰及背景变化。
Image
阶跃星辰发布三款Step系列通用大模型新品
据36氪获悉,2024世界人工智能大会在上海召开。
阶跃星辰首发了三款Step系列通用大模型新品:Step-2万亿参数语言大模型正式版、Step-1.5V多模态大模型、Step-1X图像生成大模型。据介绍,最新发布的Step-2万亿参数语言大模型正式版,采用了创新的MoE混合专家模型架构。
Image
今日重点论文:
Salesforce AI Research:
《APIGen: Automated Pipeline for Generating Verifiable and Diverse Function-Calling Datasets》
本论文旨在解决函数调用应用程序中数据集多样性、可靠性和高质量的问题,提出了一种自动化数据生成管道APIGen,旨在以可扩展和结构化的方式生成多样的函数调用数据集。APIGen通过三个层次的验证(格式检查、实际函数执行和语义验证)确保数据集的可靠性和正确性,并证明即使只有7B参数,使用他们精心策划的数据集训练的模型也可以在Berkeley函数调用基准测试中实现最先进的性能,超越多个GPT-4模型。
论文地址:
https://arxiv.org/abs/2406.18518v1
谷歌 :
《Computational Life: How Well-formed, Self-replicating Programs Emerge from Simple Interaction》
研究自复制程序在计算机编程语言中的出现机制,探究自复制程序的产生是否是随机交互和自我修改的结果。在没有明确适应度规则的情况下,随机的非自复制程序在计算机编程语言环境中会产生自复制程序。自复制程序的产生是由于随机交互和自我修改的结果。
论文地址:
https://arxiv.org/abs/2406.19108v1
Meta:
《Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations》
本文试图解决大规模推荐系统中深度学习推荐模型无法随计算能力扩展的问题,提出了一种新的架构HSTU,并将推荐问题重新表述为生成建模框架中的序列传导任务。本文提出的HSTU架构在高基数、非平稳流推荐数据上表现优异,比基线模型在综合和公共数据集上的NDCG指标提高了高达65.8%,而且在8192长度序列上比基于FlashAttention2的Transformer快5.3倍到15.2倍。基于HSTU的生成推荐器在在线A/B测试中提高了12.4%的度量,并已经部署在一个拥有数十亿用户的大型互联网平台的多个表面。
论文地址:
https://arxiv.org/abs/2402.17152v3
普林斯顿大学:
《AI Agents That Matter》
评估人工智能代理的基准测试存在哪些问题,如何解决这些问题?通过联合优化准确度和成本来设计和实现优化方案,以避免过度拟合,并提高代理的实用性。论文提出了一种联合优化代理的准确度和成本的方案,并展示了其潜力。同时,论文还强调了基准测试中其他指标的重要性,提供了避免过度拟合的框架,并呼吁标准化评估实践以提高可重复性。
论文地址:
https://arxiv.org/abs/2407.01502v1
Image