3 月 15 日 AI 头条:苹果公布多模态大模型 MM1 ,具备300亿参数
划重点:
苹果公布多模态大模型 MM1 ,具备300亿参数
英伟达将推出生成式AI专业认证
智谱 AI 完成新一轮融资:北京市人工智能产业投资基金参投,具体金额不便透露
李开复旗下 AI 模型“零一万物 API”上线,支持文档理解、图片问答等
云安全公司Zscaler 收购 Avalor,将更多 AI 引入其安全工具
腾讯联合清华大学、香港科技大学推出全新图生视频模型“Follow-Your-Click”:用户指哪动哪
AI 芯片初创公司 Cerebras 发布号称最强大 AI 芯片 WSE-3 ,4 万亿晶体管 5nm 工艺制程
资讯详情:
苹果公布多模态大模型 MM1 ,具备300亿参数
Arxiv 页面显示,苹果正式公布了自研多模态大模型 MM1,其参数最高可达 300 亿。
论文显示,MM1多模态大模型由密集模型和混合专家(MoE)变体组成,不仅在预训练指标中实现 SOTA,在一系列已有多模态基准上监督微调后也能保持有竞争力的性能。
MM1 在上下文预测、多图像和思维链推理等方面具有不错的表现。同样,MM1 在指令调优后展现出了强大的少样本学习能力。
据36氪报道,英伟达官微消息,英伟达将在GTC大会上正式推出生成式AI专业认证,能够使开发者、职场人士和其他相关人员证明和展示自己在生成式AI方面的技能和专业实力。
李开复旗下零一万物日前上线官方API ,用户可以体验 Yi 系列 AI 大模型,其中包含 yi-34b-chat-0205、yi-34b-chat-200k、yi-vl-plus。
据介绍,Yi-34B-Chat 系列 API 具备较快的推理速度,这不仅缩短了处理时间,同时也保持了出色的模型效果。此外,优化的 API 接口显著降低了模型回复的延迟,进一步提高了用户体验的流畅性和响应速度。
此外,Yi Model API 与 OpenAI API 完全兼容,用户只需修改少量代码,可以平滑迁移。
据 TechCrunch 报道云安全公司Zscaler在网络安全初创公司Avalor成立 26 个月后以 3.1 亿美元现金和股权收购了该公司。
Zscaler 创始人兼首席执行官 Jay Chaudhry 在宣布这一消息的新闻稿中表示,此次交易将扩展 Zscaler 的平台,其功能包括简化安全事件报告、事件缓解、资产发现、数据分类、安全策略生成等。Avalor 充当网络安全资产、控制、身份、漏洞、错误和其他数据点的真实来源,使安全团队能够聚合、规范化、消除重复和跟踪从发现到补救的风险数据。
腾讯联合清华大学、香港科技大学推出全新图生视频模型“Follow-Your-Click”:用户指哪动哪
据环球网报道,腾讯和清华大学、香港科技大学联合推出全新图生视频模型 “Follow-Your-Click”,目前已经上架 GitHub(代码四月公开),同时还发表了一篇研究论文。
这款图生视频模型主要功能包括局部动画生成和多对象动画,支持多种动作表达,如头部调整、翅膀拍动等。
据介绍, Follow-Your-Click 可以通过用户的点击和简短动作提示生成局部图像动画。用户只需点击对应区域,加上少量提示词,就可以让图片中原本静态的区域动起来,一键转换成视频,比如让物体微笑、跳舞或飘动。
据澎湃新闻报道,AI 芯片初创公司 Cerebras 重磅发布了 AI 芯片 WSE-3 ,4 万亿晶体管 5nm 工艺制程。更厉害的是,WSE-3 打造的单个超算可训出 24 万亿参数模型,相当于 GPT-4 / Gemini 的十倍大。
性能上,WSE-3 是上一代 WSE-2 的两倍,且功耗依旧保持不变。采用90 万个 AI 核心,44GB 的片上 SRAM 存储,让 WSE-3 的峰值性能达到了 125 FP16 PetaFLOPS。相当于 52 块英伟达 H100 GPU。
利哈伊大学:
《TRUSTLLM: TRUSTWORTHINESS IN LARGE LANGUAGE MODELS》
提出了8个不同维度的可信度原则,并在6个维度上建立了基准,包括真实性、安全性、公平性、鲁棒性、隐私和机器伦理。评估了16个主流LLMs的可信度,并发现可信度和实用性呈正相关关系。同时发现专有LLMs在可信度方面通常优于大部分开源LLMs。实验使用了30个数据集,并提出了一些开放性挑战和未来方向。同时发现有些LLMs过于校准以展示可信度,导致误将良性提示视为有害。
论文地址:
https://arxiv.org/abs/2401.05561v2
谷歌:
Meta:
《Self-Rewarding Language Models》
哈佛大学:
澳大利亚吉朗应用人工智能研究院: