
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
ShareGPT4V作者团队又一力作!百万高质量视频-字幕数据助力社区提升多模态大模型视频理解及生成能力
ShareGPT4Video系列,旨在通过密集和精确的字幕促进大型视频语言模型(LVLMs)的视频理解和文本生成视频模型(T2VMs)的视频生成。
阅读全文 :ShareGPT4V作者团队又一力作!百万高质量视频-字幕数据助力社区提升多模态大模型视频理解及生成能力超越CVPR 2024方法,DynRefer在区域级多模态识别任务上,多项SOTA
该研究提出了一种动态分辨率方案来模拟人类视觉认知系统。
阅读全文 :超越CVPR 2024方法,DynRefer在区域级多模态识别任务上,多项SOTA北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
RoboMamba:基于多模态状态空间大模型的高效机器人推理和操纵。
阅读全文 :北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作CVPR 2024全部奖项公布!近万人线下参会,谷歌华人研究员获最佳论文奖
今年共有 10 篇论文获奖,其中 2 篇最佳论文,2 篇最佳学生论文,另外还有 2 篇最佳论文提名和 4 篇最佳学生论文提名。
阅读全文 :CVPR 2024全部奖项公布!近万人线下参会,谷歌华人研究员获最佳论文奖突发!Ilya Sutskever成立新公司SSI,安全超级智能是唯一目标与产品
我们追求的安全、进步将不会受到短期商业压力的影响。
阅读全文 :突发!Ilya Sutskever成立新公司SSI,安全超级智能是唯一目标与产品清华等高校推出首个开源大模型水印工具包MarkLLM,支持近10种最新水印算法
MarkLLM工具包助力维护大模型水印技术良好生态,欢迎交流。
阅读全文 :清华等高校推出首个开源大模型水印工具包MarkLLM,支持近10种最新水印算法3D 版 SORA 来了!DreamTech 推出全球首个原生 3D-DiT 大模型 Direct3D
这是首个公开发布的原生三维生成路线的 3D 大模型
阅读全文 :3D 版 SORA 来了!DreamTech 推出全球首个原生 3D-DiT 大模型 Direct3D