
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
ICLR 2026 | 阿里高德发布SpatialGenEval,揭秘谁才是真正的文生图大师
SpatialGenEval 为 T2I 模型从“美学生成”迈向“逻辑感知”建立了一条新的评估路线
阅读全文 :ICLR 2026 | 阿里高德发布SpatialGenEval,揭秘谁才是真正的文生图大师Claude最强Sonnet模型4.6来了,百万token上下文
对编码、计算机使用、长上下文推理、智能体规划、知识工作和设计进行了全面升级。
阅读全文 :Claude最强Sonnet模型4.6来了,百万token上下文北大、高德联合出品 | 仅凭几张卫星图,即可重建出逼真3D城市
Orbit2Ground 巧妙地结合了城市几何先验与生成式 AI
阅读全文 :北大、高德联合出品 | 仅凭几张卫星图,即可重建出逼真3D城市ICLR 2026 | PIL:基于线性代理的不可学习样本生成方法
通过线性模型作为代理,直接生成能够诱导深模型线性化的不可学习扰动。
阅读全文 :ICLR 2026 | PIL:基于线性代理的不可学习样本生成方法Seed 2.0刷新Arena榜单,国产模型排名最高
这几天国产大模型有点猛。 前几天我们报道了自 2024 年 5 月正式发布以来,字节大模型首次大版本的跨代升级 ——Seed 2.0。 今天就在 LMArena Leaderboard Changelog 上注意到了它取得的成绩。 简单来说,Seed-2.0 首次参加 LMArena(现在的 Arena),就在文本竞…
阅读全文 :Seed 2.0刷新Arena榜单,国产模型排名最高单个LLM已不够?华盛顿大学开源多模型协同框架MoCo
为了支持多模型协同研究并加速这一未来愿景的实现,研究人员提出 MoCo—— 一个针对多模型协同研究的 Python 框架。
阅读全文 :单个LLM已不够?华盛顿大学开源多模型协同框架MoCoICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」
把 what / when / how(用什么、何时用、怎么用)当成推理能力来学。
阅读全文 :ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」还在玩AI 3D手办?Gemini 3 Deep Think已能直出STL,可打印实物
专业 3D 建模几乎被压缩成了「一键生成」。
阅读全文 :还在玩AI 3D手办?Gemini 3 Deep Think已能直出STL,可打印实物ICLR 2026 | CineTrans: 首个转场可控的多镜头视频生成模型,打破闭源技术壁垒
CineTrans 提出块对角掩码的通用机制,使视频生成模型能高效地自动化转场。
阅读全文 :ICLR 2026 | CineTrans: 首个转场可控的多镜头视频生成模型,打破闭源技术壁垒