
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
北大团队提出 SHINE:将任意文本转化为大模型 LoRA,仅需一次前向传播!
文本中的知识可以被直接内化到大模型参数中,并支持基于该文本进行多轮对话。
阅读全文 :北大团队提出 SHINE:将任意文本转化为大模型 LoRA,仅需一次前向传播!必看!Sebastian Raschka新博客盘点了所有主要注意力机制
从 MHA 和 GQA 到 MLA、稀疏注意力以及混合架构
阅读全文 :必看!Sebastian Raschka新博客盘点了所有主要注意力机制创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型
完整开源生成模型、超分模型以及推理代码。
阅读全文 :创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型CVPR 2026 | 中科院、港中文等提出HiFi-Inpaint:无损还原物体细节,重塑Inpainting生成范式!
显式地将 “高频特征” 提取出来,直接注入到网络结构和损失函数中。
阅读全文 :CVPR 2026 | 中科院、港中文等提出HiFi-Inpaint:无损还原物体细节,重塑Inpainting生成范式!告别Docker:北大开源「迷你沙盒」,无容器也能训练SWE Agent
让资源不多的从业者也能训练自己的SWE Agent
阅读全文 :告别Docker:北大开源「迷你沙盒」,无容器也能训练SWE AgentContext 还不够,Harness 才是 Agent 工程优化的正解?
Harness Engineering 将是 Context Engineering 之后的新范式?
阅读全文 :Context 还不够,Harness 才是 Agent 工程优化的正解?CVPR 2026 | 从「单帧」到「分镜」:STAGE重新定义AI电影叙事
一个以 “电影分镜” 为核心的全新叙事生成框架。
阅读全文 :CVPR 2026 | 从「单帧」到「分镜」:STAGE重新定义AI电影叙事Andrej Karpathy最新播客:Token没用完让人焦虑,就像患上「AI精神病」
每天和 Agent 对话 16 小时,不再手写代码。
阅读全文 :Andrej Karpathy最新播客:Token没用完让人焦虑,就像患上「AI精神病」比现有框架快22倍,浙大开源EasySteer:高性能LLM Steering统一框架
相比现有 Steering 框架实现了 10.8-22.3 倍的推理加速
阅读全文 :比现有框架快22倍,浙大开源EasySteer:高性能LLM Steering统一框架ICLR 2026 | 清华提出交叉熵分解:“误差熵”才是大模型规模定律真正的驱动项
这或许能为理解大模型的能力边界和优化方向提供新的指引。
阅读全文 :ICLR 2026 | 清华提出交叉熵分解:“误差熵”才是大模型规模定律真正的驱动项ICLR 2026 | Shop-R1: 给AI补上「内心戏」,在RL博弈中复刻人类网购脑
实现从 “任务完成” 到 “行为模拟” 的范式转移。
阅读全文 :ICLR 2026 | Shop-R1: 给AI补上「内心戏」,在RL博弈中复刻人类网购脑