PostgreSQL码农集散地

逆天了, 智谱GLM 5综合能力全球第一

现在国外的模型不管是chatgpt还是cc都面临各种封锁, 快看过来吧, 国内模型可以的!

GLM-5-Turbo (智谱) 在权威的ClawBench评测中,以93.9分 登顶全球榜首 ,展现了最强的综合任务解决能力。

通过邀请码注册还能获得2千万免费 token 大礼包: https://www.bigmodel.cn/invite?icode=o%2BGu1VZ023vF4clp1LIbLv2gad6AKpjZefIo3dVEQyA%3D

以下是基于截至2026年3月底的公开数据,在各个关键能力维度上表现领先的模型:

能力维度
领先模型
关键表现 / 数据
综合智能体能力GLM-5-Turbo
 (智谱)
在权威的ClawBench评测中,以93.9分登顶全球榜首,展现了最强的综合任务解决能力。
软件工程与编程Claude Opus 4.6
 (Anthropic)
SWE-bench基准得分65.3% ,是处理真实世界GitHub问题的首选。
GLM-5
 (智谱)
在最新的SWE-rebench榜单上排名第三,是排名最高的开源模型。
科学推理与难题Gemini 3.1 Pro Preview
 (谷歌)
在博士级科学推理基准GPQA Diamond上得分94.3% ,并在专家级难题集HLE上领先。
用户盲测喜好Claude Opus 4.6
 (Anthropic)
在LMSYS Chatbot Arena(大模型竞技场)中Elo评分第一,是最受用户欢迎的模型。
数学能力Qwen3.5-Max-Preview
 (阿里)
在LMArena数学能力子榜单中排名全球第五、中国第一。
中文任务Qwen系列、DeepSeek系列
 (国内厂商)
在中文理解、知识问答等任务上,国产模型优势显著,且API访问更稳定。
Image