CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
在3D数据长期稀缺的背景下,利用「无标注视频」将是推动具身智能体、3D VLM以及下一代空间基础模型的关键路径!
阅读全文 :CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
专业的人工智能媒体和产业服务平台
在3D数据长期稀缺的背景下,利用「无标注视频」将是推动具身智能体、3D VLM以及下一代空间基础模型的关键路径!
阅读全文 :CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据一个训练数据截止到 1911 年的模型,能不能自己推导出爱因斯坦 1915 年提出的广义相对论?
阅读全文 :哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型我们能不能把黑箱直接改造成更接近 “玻璃箱” 的系统?
阅读全文 :ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展面对越来越长的文档,真正需要的是一种更智能的信息获取策略!
阅读全文 :ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点大模型 3D 空间推理的下一个突破口,也许在于如何释放生成式基础模型体内早已沉睡的 “物理先验”。
阅读全文 :VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解与具身交互以 “无训练、黑箱适配、类别专属权重” 为核心,精准解决了当前 VLM 零样本分类中提示词语义适配不足的问题
阅读全文 :无需训练,如何提升黑箱VLM?CARPRT用「类别感知」给出答案将数据废料转化为数据燃料,这不仅是技术解法,更是银河通用的核心数据观 。
阅读全文 :超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law显著降低长上下文大模型的硬件门槛、推理成本与部署难度。
阅读全文 :ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速早期连续 DLM 的表现不佳并非源于架构的先天缺陷,而是受限于训练策略与评估方法。
阅读全文 :LangFlow: 挑战离散扩散,探索下一代语言模型新范式在没有刻意诱导、只是正常提问的情况下,模型会不会也出现某种 “表面这样答,实际那样想” 的现象。
阅读全文 :ICLR 2026 Oral | 没人诱导,大模型也会「骗人」不仅告诉模型每一步推得对不对,还让它为啰嗦付出代价。
阅读全文 :ACL 2026|答得更准还写得更短?华为泰勒实验室提出SHAPE,给LLM推理装了个「推理税」