
公众号
机器之心
专业的人工智能媒体和产业服务平台
这个来源的文章
斯坦福训练Transformer替代模型:1.7亿参数,能除偏、可控可解释性强
斯坦福大学的研究者提出了可干预的 Backpac k 语言模型,通过调控意义向量来干预语言模型行为,引导语言模型输出想要的结果。
阅读全文 :斯坦福训练Transformer替代模型:1.7亿参数,能除偏、可控可解释性强赋予LLM视觉理解能力,360人工智能研究院开源中文多模态对话模型SEEChat
将视觉能力与已有的 LLM 模型相融合,打造侧重视觉能力的多模态语言模型 MLLM
阅读全文 :赋予LLM视觉理解能力,360人工智能研究院开源中文多模态对话模型SEEChatBert on ABSA、ASGCN、GAN、Sentic GCN…你都掌握了吗?一文总结情感分析必备经典模型(三)
机器之心专栏本专栏由机器之心SOTA!模型资源站出品,每周日于机器之心公众号持续更新。 本专栏将逐一盘点自
阅读全文 :Bert on ABSA、ASGCN、GAN、Sentic GCN…你都掌握了吗?一文总结情感分析必备经典模型(三)大模型也有好玩的数学? 从麦克斯韦的最低势能问题到人机对齐
在本篇文章中,来自斯坦福大学、普林斯顿大学和宾夕法尼亚大学的研究者们联合发表了一篇论文,分析了大型语言模型对齐中的“奖励坍缩”现象。
阅读全文 :大模型也有好玩的数学? 从麦克斯韦的最低势能问题到人机对齐教科书级数据is all you need:1.3B小模型逆袭大模型的秘密
吴恩达说的「小数据」有多大威力?这个只有 1.3B 参数量的模型给出了证明。
阅读全文 :教科书级数据is all you need:1.3B小模型逆袭大模型的秘密「从未被制造出的最重要机器」,艾伦·图灵及图灵机那些事
「这些抽象机器也许是最好的证据,证明提出基本问题可能是科学家能够做的最有用的事情之一。」
阅读全文 :「从未被制造出的最重要机器」,艾伦·图灵及图灵机那些事倾听AI领袖的声音,大模型时代AI的热点,尽在这场WAIC论坛
多模态、AIGC、对齐、涌现、大模型训练、联邦大模型…… 2023WAIC上一起聊聊
阅读全文 :倾听AI领袖的声音,大模型时代AI的热点,尽在这场WAIC论坛基于Transformer的大模型是如何运行的?Meta从全局和上下文学习揭秘
本文旨在更好地理解基于Transformer的大型语言模型(LLM)的内部机制。
阅读全文 :基于Transformer的大模型是如何运行的?Meta从全局和上下文学习揭秘近十年首次,国内机构上海AI Lab、武大、商汤研究获CVPR 2023最佳论文
近十年来三大顶会最佳论文首次被国内研究获得。
阅读全文 :近十年首次,国内机构上海AI Lab、武大、商汤研究获CVPR 2023最佳论文浙大团队将化学知识引入机器学习,提出可外推、可解释的分子图模型预测反应性能
本文提出了一种嵌入数字化空间和电子信息的基于知识的分子图模型。
阅读全文 :浙大团队将化学知识引入机器学习,提出可外推、可解释的分子图模型预测反应性能