SIGGRAPH Asia 2025|当视频生成真正「看清一个人」:多视角身份一致、真实光照与可控镜头的统一框架
在视频生成中,身份是一个人在多视角与多光照条件下保持稳定的 4D 表现。
阅读全文 :SIGGRAPH Asia 2025|当视频生成真正「看清一个人」:多视角身份一致、真实光照与可控镜头的统一框架
专业的人工智能媒体和产业服务平台
在视频生成中,身份是一个人在多视角与多光照条件下保持稳定的 4D 表现。
阅读全文 :SIGGRAPH Asia 2025|当视频生成真正「看清一个人」:多视角身份一致、真实光照与可控镜头的统一框架通过将自提炼的并行 SFT 与智能体并行 RL 相结合,NPR 能够生成真正的并行推理策略。
阅读全文 :告别「单线程」思维:通研院提出NPR框架,让智能体进化出原生的并行推理大脑不直接依赖模型底层调优,而通过优化推理过程来进一步提升模型性能。
阅读全文 :无需再训练微调,一个辅助系统让GPT-5.2准确率飙到创纪录的75%首个面向图生视频模型的多模态自进化越狱攻击框架。
阅读全文 :越狱成功率飙升至87.6%,南京大学联合美团、上交破解主流视频生成模型安全漏洞标志着端到端自动驾驶规划向离散化、结构化、闭环化迈出了重要一步。
阅读全文 :刷新NAVSIM SOTA,复旦引望提出Masked Diffusion端到端自动驾驶新框架李学龙团队为VLA模型的实际部署提供了新思路
阅读全文 :直面VLA的「阿喀琉斯之踵」:TeleAI用「反探索」提升具身推理稳定性拥有更丰富的情感层次、更精准的多角色互动,对复杂文本指令的深度理解能力,以及支持长达 5 分钟的视频生成
阅读全文 :从「会表演」到「更会演」:KlingAvatar2.0让数字人拥有生动灵魂