
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
AdamW和Muon的失稳根源有解了,港中文新优化器Pion:在等谱流形上更新大模型
Pion 优化器:基于等谱流形的大模型稳定高效训练新范式
阅读全文 :AdamW和Muon的失稳根源有解了,港中文新优化器Pion:在等谱流形上更新大模型不止会写代码:清华和极佳联合开源多模态全交互智能体框架Syll!
打造更易用、更可信、更安全,也更适合二次开发的个人自动化智能体框架。
阅读全文 :不止会写代码:清华和极佳联合开源多模态全交互智能体框架Syll!面对相同的物理法则,GPU、FPGA与碳基大脑为何走向不同分支?
前谷歌 LLM Infra 团队成员、MatX 联创 Reiner Pope 如何剖析算力对不同芯片架构的影响?
阅读全文 :面对相同的物理法则,GPU、FPGA与碳基大脑为何走向不同分支?CVPR 2026 | 当LoRA遇上RoPE!WaDi:面向单步图像生成的权重方向感知蒸馏
本工作为高效扩散模型蒸馏提供了新颖的理论视角和实践方案。
阅读全文 :CVPR 2026 | 当LoRA遇上RoPE!WaDi:面向单步图像生成的权重方向感知蒸馏阶跃发布Step 3.7 Flash:一款为「烧钱时代」准备的Agent模型
为什么顶级厂商都在押注Flash模型?
阅读全文 :阶跃发布Step 3.7 Flash:一款为「烧钱时代」准备的Agent模型DiffusionOPD:复旦联合通义万相提出扩散模型「在线策略蒸馏」新范式,让学⽣模型同时学会构图、⽂字与美学
为diffusion领域的On-Policy Distillation提供了一个统一视角,并建立了相应的理论与实验框架。
阅读全文 :DiffusionOPD:复旦联合通义万相提出扩散模型「在线策略蒸馏」新范式,让学⽣模型同时学会构图、⽂字与美学消耗1830亿token,Meta用AI把数学教材翻译成了一个超大Lean库
Meta 开源了当今规模最大的自动数学形式化工程
阅读全文 :消耗1830亿token,Meta用AI把数学教材翻译成了一个超大Lean库让机器人动作流畅丝滑如「连音」,千寻智能高阳团队提出Legato,入选RSS 2026
突破动作分块模态切换瓶颈,Legato 实现原生连续动作生成
阅读全文 :让机器人动作流畅丝滑如「连音」,千寻智能高阳团队提出Legato,入选RSS 2026重塑人机对话理解范式,Google新数据集首次大规模捕捉用户「未言明的想法」
ThoughtTrace 打开了三条新的研究方向。
阅读全文 :重塑人机对话理解范式,Google新数据集首次大规模捕捉用户「未言明的想法」