
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
Attention机制竟有bug,Softmax是罪魁祸首,影响所有Transformer
统计工程师发现了transformer难以压缩的原因。
阅读全文 :Attention机制竟有bug,Softmax是罪魁祸首,影响所有Transformer山大SIGGRAPH 2023 最佳论文得主分享:点云法向估计及保特征重建
SIGGRAPH最佳论文奖作者分享点云重建新算法和方法。
阅读全文 :山大SIGGRAPH 2023 最佳论文得主分享:点云法向估计及保特征重建本科毕业加入谷歌,还写了「思维链」开山之作,这位OpenAI新秀正为本科生答疑解惑
Jason Wei 从他的视角为年轻 AI 研究者提供了一些建议。
阅读全文 :本科毕业加入谷歌,还写了「思维链」开山之作,这位OpenAI新秀正为本科生答疑解惑树莓派上运行 Stable Diffusion,260MB 的 RAM「hold」住 10 亿参数大模型
Stable Diffusion 能在树莓派上运行了!
阅读全文 :树莓派上运行 Stable Diffusion,260MB 的 RAM「hold」住 10 亿参数大模型CTPN、TextBoxes、SegLink、RRPN、FTSN、DMPNet…你都掌握了吗?一文总结OCR必备经典模型(一)
机器之心专栏本专栏由机器之心SOTA!模型资源站出品,每周日于机器之心公众号持续更新。 本专栏将逐一盘点自
阅读全文 :CTPN、TextBoxes、SegLink、RRPN、FTSN、DMPNet…你都掌握了吗?一文总结OCR必备经典模型(一)我为什么放弃了 LangChain?
「LangChain 的流行已经扭曲了围绕其本身的人工智能创业生态系统,这就是为什么我不得不坦诚自己对它的疑虑。」
阅读全文 :我为什么放弃了 LangChain?ImageNet-1K压缩20倍,Top-1精度首超60%:大规模数据集蒸馏转折点
该工作是目前唯一实现了大规模高分辨率数据集蒸馏的框架
阅读全文 :ImageNet-1K压缩20倍,Top-1精度首超60%:大规模数据集蒸馏转折点南洋理工大学最新视觉语言模型综述:预训练、迁移学习和知识蒸馏啥都有
本综述还将持续关注针对视觉识别任务的最新视觉语言模型相关工作。
阅读全文 :南洋理工大学最新视觉语言模型综述:预训练、迁移学习和知识蒸馏啥都有12种模态,一个学习框架,Meta-Transformer实现骨干网络大一统
「战斗」Meta-Transformer实现模态「大一统」。
阅读全文 :12种模态,一个学习框架,Meta-Transformer实现骨干网络大一统