
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
字节豆包、武大提出 CAL:通过视觉相关的 token 增强多模态对齐效果
武汉大学、字节跳动豆包大模型团队和中国科学院大学的研究人员提出了一种基于对比学习的文本 token 筛选方法(CAL),实现更精准的多模态对齐。
阅读全文 :字节豆包、武大提出 CAL:通过视觉相关的 token 增强多模态对齐效果新一轮「硬件彩票」:MatMul-free 会改变大模型的游戏规则吗?
本期通讯 25913 字,可免费试读至 14%。
阅读全文 :新一轮「硬件彩票」:MatMul-free 会改变大模型的游戏规则吗?高质量3D生成最有希望的一集?GaussianCube在三维生成中全面超越NeRF
都什么年代了,还在用传统 NeRF 进行三维生成建模?
阅读全文 :高质量3D生成最有希望的一集?GaussianCube在三维生成中全面超越NeRF听说,Stable Diffusion 3 人物生成大翻车了?|直播预告
机器之心特别策划了一场直播,来全面测评一下 Stable Diffusion 3 究竟好不好。
阅读全文 :听说,Stable Diffusion 3 人物生成大翻车了?|直播预告仅存活三个月的Copilot GPTs,因无盈利希望,被微软强制「退休」
短命的 Copilot GPTs,手忙脚乱的微软?
阅读全文 :仅存活三个月的Copilot GPTs,因无盈利希望,被微软强制「退休」SIGGRAPH2024|上科大、影眸联合提出DressCode:从文本生成3D服装板片
上海科技大学、影眸科技与宾夕法尼亚大学联合提出了一个文本驱动的 3D 服装生成框架——DressCode。
阅读全文 :SIGGRAPH2024|上科大、影眸联合提出DressCode:从文本生成3D服装板片Mobile-Agent-v2问世,自动化手机操作能力再上新台阶
Mobile-Agent-v2发布,继续保留纯视觉方案,多智能体协作的架构,拥有更强的任务拆解、跨应用操作和多语言能力。
阅读全文 :Mobile-Agent-v2问世,自动化手机操作能力再上新台阶从ALOHA迈向Humanplus,斯坦福开源人形机器人,「高配版人类」上线
斯坦福团队开源 Humanplus 类人机器人,展示人类同步操作。
阅读全文 :从ALOHA迈向Humanplus,斯坦福开源人形机器人,「高配版人类」上线万字综述大模型高效推理:无问芯穹与清华、上交最新联合研究全面解析大模型推理优化
从数据层、模型层、系统层全面解析大模型推理优化
阅读全文 :万字综述大模型高效推理:无问芯穹与清华、上交最新联合研究全面解析大模型推理优化