资讯详情:英伟达 AI 芯片 H200 开始发货,性能大幅提升据 ytech 报道,英伟达宣布 H200 GPU 正式发布并发货,这是人工智能行业的一项重大进展。H200 GPU通过在新推出的Hopper架构图形处理器上实施先进的推理解决方案TensorRT-LLM,英伟达展示了其高效处理GPT-J等复杂大型语言模型(LLM)的能力,而且速度和精度都非常出色。H200 GPU最近在MLPerf基准测试中首次亮相,以每秒生成高达31,000个令牌的速度展示了非凡的吞吐量。xAI 正式推出 Grok-1.5 大模型,即将上线X据 xAI 在官方博客中宣布,正式推出 Grok-1.5 大语言模型。Grok-1.5 具有改进的推理能力和 128k 的上下文长度,其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 X 平台上向早期测试人员和现有的 Grok 用户推出。Meta 计划下月起为雷朋智能眼镜增加 AI 功能据the Verge 报道,Meta表示从下月起将为其雷朋智能眼镜引入人工智能。雷朋智能眼镜的多模态人工智能功能可以进行翻译,还可以识别物体、动物和古迹,从去年 12 月起就已经进入早期使用阶段。用户只需说出 "Hey Meta",然后说出提示语或提出问题,就能激活眼镜的智能助手。然后,它就会通过镜框内置的扬声器作出回应。钉钉 AI 助理升级,上线多种新功能钉钉宣布 AI 助理升级。升级后上线了图片理解、文档速读、工作流等产品能力,率先探索多模态、长文本与 RPA 技术在 AI 应用的落地。基于阿里通义千问大模型,升级后的钉钉 AI 助理可以做到:进入 AI 助理对话框,发送长文件、在线文档、网页链接、视频内容,即可根据内容识人、识地点、分析、答题、翻译、摘要、提取文字,甚至可以通过多轮交互进一步做智能问答。能够准确描述和识别图片信息,并根据图片进行信息推理、扩展创作、文字提取、翻译等。可以快速阅读本地文件如 Word、PDF、PPT、Excel 等、钉钉文档、网页链接等多种格式文件,轻松解析各类学术论文、产品手册、使用教程、数据表格、新闻报道、多国语言的图书等。ColorOS AI 功能上新:支持英语教学、面试培训和问答互动OPPO 官方今日宣布,ColorOS 全新 AI 功能上线,支持多项面对面 AI 功能。更新之后,ColorOS新增小布英语老师,支持AI 模拟真人教学,提供一对一口语陪练。新增小布面试官,支持 AI 模拟面试,帮助用户掌握面试技巧。新增小布问答,该功能旨在帮助用户完成各类商品评论、社交平台文案,以及全套旅行规划等。周鸿祎宣布将开源 360 智脑模型,支持 50 万字长文本输入360 创始人周鸿祎近日透露即将开源 360 智脑 7B(70 亿参数模型),支持 360k(50 万字)长文本输入。周鸿祎表示,前段时间大模型行业卷文本长度,100 万字“很快将是标配”。“我们打算将这个能力开源,大家没必要重复造轮子,定为 360k 主要是为了讨个口彩。”周鸿祎还表示自己信奉开源的力量。中兴预计下月发布多款努比亚 AI 手机新品据财联社报道,中兴通讯近日召开2023业绩说明会,并在会上宣布,预计今年 4 月将发布多款努比亚 AI 手机新品,年中将发布首款 AI 旗舰手机。据中兴表示,未来,公司将基于中兴星云 OS 系统,实现各类业务接入统一的 AI 平台,整合大模型、大数据和 3D 技术,在影像、性能、安全等方面进行全栈赋能。今日重点论文:
中国科学技术大学:
《GaussianCube: Structuring Gaussian Splatting using Optimal Transport for 3D Generative Modeling》
本文旨在解决3D高斯喷射(GS)在生成建模方面的挑战,提出了一种新的结构化GS表示方法——GaussianCube,以提高生成建模的效率和质量。本文提出了一种修改后的密度约束GS拟合算法,将散布的高斯重新排列到预定义的体素网格中,形成结构化的表示方法。这种表示方法可以使用标准的3D U-Net作为骨干网络进行扩散生成建模,无需复杂的设计。论文地址:https://arxiv.org/abs/2403.19655v1北京航空航天大学:《RSMamba: Remote Sensing Image Classification with State Space Model》论文旨在提出一种新的远程感知图像分类方法,以应对远程感知场景分类面临的挑战。论文提出了一种基于状态空间模型(SSM)和硬件感知设计Mamba的新架构RSMamba,以整体图像理解为基础,结合全局感受野和线性建模复杂性的优点,采用动态多路径激活机制来增强Mamba对非因果数据的建模能力。论文在多个远程感知图像分类数据集上展示了RSMamba的卓越性能,并提供了开源代码。该方法的成功表明RSMamba有望成为未来视觉基础模型的骨干。论文地址:https://arxiv.org/abs/2403.19654v1Adobe:
《Detecting Image Attribution for Text-to-Image Diffusion Models in RGB and Beyond》