ChatGPT如何「思考」?心理学和神经科学破解AI大模型,Nature发文
努力对AI进行逆向工程,并扫描LLM的「大脑」。
阅读全文 :ChatGPT如何「思考」?心理学和神经科学破解AI大模型,Nature发文
专业的人工智能媒体和产业服务平台
努力对AI进行逆向工程,并扫描LLM的「大脑」。
阅读全文 :ChatGPT如何「思考」?心理学和神经科学破解AI大模型,Nature发文PPPL 的 AI 研究取得重大成果。
阅读全文 :可控核聚变新里程碑,AI首次实现双托卡马克3D场全自动优化,登Nature子刊该研究提供了超过200个从不同规模开源大模型序列压缩而来的低比特量化小模型。
阅读全文 :只需单卡RTX 3090,低比特量化训练就能实现LLaMA-3 8B全参微调第一个以「泛化」能力为核心设计原则的可学习图像匹配器来了!
阅读全文 :用基础模型指导特征传播,首个泛化型图像匹配器OmniGlue搞定未见过域既能像 Transformer 一样并行训练,推理时内存需求又不随 token 数线性递增,长上下文又有新思路了?
阅读全文 :Bengio等人新作:注意力可被视为RNN,新模型媲美Transformer,但超级省内存可观察的扩展定律(Observational Scaling Laws)
阅读全文 :从80个模型中构建Scaling Law:华人博士生新作,思维链提出者力荐一念 LLM,取 “一念三千” 之意,寓意 “一念之间,用大模型生成世间万象”
阅读全文 :腾讯PCG自研高性能大语言模型推理引擎「一念LLM」正式开源该workshop聚焦于多模态基础模型(MFM)、具身智能(EAI)以及两项研究的交叉领域。
阅读全文 :大模型与具身智能的火花,ICML 2024 MFM-EAI Workshop征稿和挑战赛启动中国电信人工智能研究院(TeleAI)李学龙教授团队联合TeleAI &上海AI Lab提出基于视觉分割模型的SAM-E方法。
阅读全文 :具身智能体三维感知新链条,TeleAI &上海AI Lab提出多视角融合具身模型「SAM-E」超越 GPT 和 AlphaFold:AI 的下一个十年将走向何方?
阅读全文 :WAIC · 云帆奖五周年:AI 青年,执掌未来十年的钥匙这种可解释性将帮助我们提高人工智能模型的安全性,具有里程碑意义。
阅读全文 :从Claude 3中提取数百万特征,首次详细理解大模型的「思维」Llama3自上个月发布以来,被称为社区最强开源模型。由于中文能力欠缺,为了弥补这一短板,开源社区已经出现了
阅读全文 :弥补中文短板,社区Llama3汉化微调版效果如何?