华为放出2023年最后一个大招?CodeArts Snap如何用大模型解放开发者
CodeArts Snap 是一个很好的开始。
阅读全文 :华为放出2023年最后一个大招?CodeArts Snap如何用大模型解放开发者
专业的人工智能媒体和产业服务平台
CodeArts Snap 是一个很好的开始。
阅读全文 :华为放出2023年最后一个大招?CodeArts Snap如何用大模型解放开发者O²-Recon利用预训练的扩散模型来补全图像中物体被遮挡的区域。
阅读全文 :清华大学提出三维重建的新方法:O²-Recon,用2D扩散模型补全残缺的3D物体2017年被提出来的Transformer,还会继续火下去吗?
阅读全文 :谁能撼动Transformer统治地位?Mamba作者谈LLM未来架构大模型及相关应用是迄今为止最为复杂的软硬件系统工程,需要系统性的创新才能应对
阅读全文 :我们深入华为这场线下闭门会,全方位围观中国大模型这一年消费级显卡在大模型领域依然「力不从心」。
阅读全文 :Llama2推理RTX3090胜过4090,延迟吞吐量占优,但被A800远远甩开不需要额外训练,也能增强大语言模型的任务性能。
阅读全文 :给Transformer降降秩,移除特定层90%以上组件LLM性能不减PaLM 2在数学推理、代码生成上显著改进,DeepMind是这样做的
阅读全文 :大模型微调非得依赖人类数据吗?DeepMind:用带反馈的自训练更好来自清华大学的研究者提出了一种新的注意力范式——代理注意力 (Agent Attention)。
阅读全文 :Softmax注意力与线性注意力的优雅融合,Agent Attention推动注意力新升级