waynblog

智谱最新视觉模型:GLM-4.5V,有点强

GLM-4.5V 基于智谱 AI的下一代旗舰文本基础模型 GLM-4.5-Air底座(106B 参数,12B 有源),延续了 GLM-4.1V-Thinking 的技术路线, 在 42 个公开的视觉语言基准测试中取得了同规模模型中的 SOTA 性能,涵盖了图像、视频和网页理解等常见任务。 于是我用智谱官网 bigmodel 提供的 GLM-4.5V 模型进行了一波 lobechat 官网的生成实测,可以看到图2是GLM-4.5V生成的,跟图3官网相似度已经达到了80%,总的来说是可以状态。具体对比,大家可以看图。 关注我,了解更多 ai 教程、业界资讯@程序员wayn