智谱AI发布第三代大模型:多模态、手机部署、网络搜索
BRAIN
近日,智谱AI推出了全自研的第三代基座大模型ChatGLM3及相关系列产品,并开源了其新发布的多模态大模型ChatGLM3-6B模型。本文将详细介绍智谱AI的第三代大模型及其特点。
AI
一、智谱AI第三代大模型ChatGLM3
智谱AI在10月份完成新的融资后,宣布2023年已累计获得超25亿人民币融资。这家成立于2019年6月的公司,去年底的估值还只有约20亿元人民币,现在则达到了140亿元,成为中国估值最高的大模型创业公司。
AI
二、瞄准GPT-4V的多模态大模型
智谱AI的第三代大模型ChatGLM3在性能、技术升级、智能体能力、端侧模型等方面均有所突破。其中,多模态理解能力的CogVLM在10余个国际标准图文评测数据集上取得SOTA;代码增强模块Code Interpreter根据用户需求生成代码并执行,自动完成数据分析、文件处理等复杂任务;网络搜索增强WebGLM接入搜索增强,能自动根据问题在互联网上查找相关资料并在回答时提供参考相关文献或文章链接
AI
三、全新的Agent智能体能力
ChatGLM3集成了自研的AgentTuning技术,激活了模型智能体能力,尤其在智能规划和执行方面,相比于ChatGLM二代提升1000%;开启国产大模型原生支持工具调用、代码执行、游戏、数据库操作、知识图谱搜索与推理、操作系统等复杂场景。
AI
四、Edge端侧模型
ChatGLM3推出可手机部署的端侧模型ChatGLM3-1.5B和ChatGLM3-3B,支持包括Vivo、小米、三星在内的多种手机以及车载平台,甚至支持移动平台上CPU芯片的推理,速度可达20 tokens/s。精度方面,ChatGLM3-1.5B和ChatGLM3-3B在公开Benchmark上与ChatGLM2-6B模型性能接近。
AI
五、更高效推理/降本增效
基于最新的高效动态推理和显存优化技术,智谱AI当前的推理框架在相同硬件、模型条件下,相较于目前最佳的开源实现,包括伯克利大学推出的vLLM以及Hugging Face TGI的最新版本,推理速度提升了2-3倍,推理成本降低一倍,每千tokens仅0.5分,成本最低。
AI
六、ChatGLM3-6B模型已开源
ChatGLM3-6B模型在44多个对话模型数据集上的9个榜单中排名第一,其开源的32k版本ChatGLM3-6B-32K在LongBench中表现最佳。多模态CogVLM-17B已开源,它在10个多模态榜单中排名第一;智能体AgentLM:让开源模型达到甚至超过闭源模型的Agent能力。
AI
七、「智谱清言」:国内首个具备代码交互能力的AI助手
在全新升级的ChatGLM3赋能下,生成式AI助手智谱清言已成为国内首个具备代码交互能力的大模型产品(Code Interpreter),可支持图像处理、数学计算、数据分析等使用场景。
智谱AI不断推陈出新,为人工智能领域带来创新与突破。随着第三代大模型ChatGLM3的发布,智谱AI将为行业带来更多可能性,助力人工智能技术的发展。