实测完OpenAI的SearchGPT,我发现它有点不太聪明的亚子。
盼星星,盼月亮。
终于盼到了OpenAI的AI搜索SearchGPT的体验资格了。 一周期,SearchGPT在跳票了将近3个月之后,终于被正式官宣了。
他也很痛快,直接给我发了一串字母。
我们在搜索框里,随便输入一个问题。 “2024年巴黎奥运会,截止北京时间2024年8月2日0点,中国队的奖牌数量?” 这个对于实时性要求极高,对数据溯源的要求也极高,如果你去拆关键词,搜很多的新闻报告,大概率就会错,你必须理解这个问题,真的去巴黎官网搜,去央视奖牌榜,或者一些三方的实时更新的榜单搜,才可能会对。 我先把这个问题的正确答案公布出来, 截止到8月2号0点,总奖牌数是 21枚 ,11金7银3铜,奖牌榜第一。
我们先看一下其他AI搜索产品的情况。
Perplexity,直接躺平,6枚,咋地,你跟我这虚空吞金牌呢?
这道题的答案,想必朋友们都知道了,是22枚。
而看到SearchGPT回答的那一刻,我心中千万只草泥马翻腾而过。
心中瞬间对 SearchGPT完成了祛魅。 当然,这个问题,毕竟是难倒所有AI搜索的杀手锏,大家都躺,你 SearchGPT躺了也不算啥。 也不能这一个问题,就一棒子把SearchGPT打死不是。 我又问了其他一些问题。 比如 “ 中国经济特区有哪些 ”, SearchGPT又G了。
答案明明是7个,却只给我回答了5个。 又比如经典问题, “9.11和9.8谁更大”
测试的维度包括:实时性、准确性、语义理解、中国特色数据、来源多样性。当然这是我自己瞎总结的野鸡维度,仅给我自己做参考用。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。 >/ 作者:卡兹克、稳稳、小瑞 >/ 投稿或爆料,请联系邮箱:[email protected]
终于盼到了OpenAI的AI搜索SearchGPT的体验资格了。 一周期,SearchGPT在跳票了将近3个月之后,终于被正式官宣了。
他也很痛快,直接给我发了一串字母。
我们在搜索框里,随便输入一个问题。 “2024年巴黎奥运会,截止北京时间2024年8月2日0点,中国队的奖牌数量?” 这个对于实时性要求极高,对数据溯源的要求也极高,如果你去拆关键词,搜很多的新闻报告,大概率就会错,你必须理解这个问题,真的去巴黎官网搜,去央视奖牌榜,或者一些三方的实时更新的榜单搜,才可能会对。 我先把这个问题的正确答案公布出来, 截止到8月2号0点,总奖牌数是 21枚 ,11金7银3铜,奖牌榜第一。
我们先看一下其他AI搜索产品的情况。
Perplexity,直接躺平,6枚,咋地,你跟我这虚空吞金牌呢?
这道题的答案,想必朋友们都知道了,是22枚。
而看到SearchGPT回答的那一刻,我心中千万只草泥马翻腾而过。
心中瞬间对 SearchGPT完成了祛魅。 当然,这个问题,毕竟是难倒所有AI搜索的杀手锏,大家都躺,你 SearchGPT躺了也不算啥。 也不能这一个问题,就一棒子把SearchGPT打死不是。 我又问了其他一些问题。 比如 “ 中国经济特区有哪些 ”, SearchGPT又G了。
答案明明是7个,却只给我回答了5个。 又比如经典问题, “9.11和9.8谁更大”
- 界面简洁,用户体验舒适;
- 抓取的信息来源质量较高,基本是权威媒体或官方信息源;
- 回答得直接,废话少;
-
卡片生态做的挺丰富的,但是大部分都是国外的;
- 可以追问;
- 有些时候只能回复英文答案;
- 一些情况下对中文语义理解能力不够;
- 准确性着实一般,有时候搜到了东西但是不调用,相信自己的模型内部知识。
- 在时间维度上的信息理解和信息抓取能力存在不足,不过这是通病了;
- 用户体验不够丰富,没有脑图、ppt之类的(maybe也算是简洁的优点?)
测试的维度包括:实时性、准确性、语义理解、中国特色数据、来源多样性。当然这是我自己瞎总结的野鸡维度,仅给我自己做参考用。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。 >/ 作者:卡兹克、稳稳、小瑞 >/ 投稿或爆料,请联系邮箱:[email protected]