用脑筋急转弯来测试AI的智商,挺没劲,挺有趣。
不论是 gpt 的知识生成,还是 o1模型的逻辑推理,对于人类来说,都是相当耗能的大脑活动。于是,出现了一种现象:用脑筋急转弯来测试 AI 的“智力水平”。不但有娱乐效果,而且没有认知门槛,不费观众的脑子,而且还有获得感:gpt 果然不行,不过如此。 例如这两天很火的这张截图,来自某大学的 AI 通识核心课第一课上的 PPT。 实际测试一下就会发现,gpt-4o,4o-mini,o1-mini,o1-preview,没有一个翻译错误,PPT 里面的观点和结论是不符合现实的。无视真实的技术巨变,对AGI 正在加速实现的现实完全不管不顾,靠脑筋急转弯来找优越感,实话说,挺打脸的。 中文语言确实在模糊性上有优势,但是认知能力毕竟不是比拼脑筋急转弯。 虽然网络上一直流行用脑筋急转弯来测试大模型,甚至以此来否定模型的智力水平,是没有多大参考价值的。 当然,作为娱乐完全没问题,别当真就行,还挺有趣的。🤣