ChatGPT竟然只排在倒数第二?
英国消费者组织最近进行了问卷调查,测试了6款主流AI工具ChatGPT、Google Gemini、Gemini AI Overview(AIO)、Copilot、Meta AI和Perplexity的准确性。没想到经过测试后,我们较为常用的ChatGPT的准确性竟然不是最高的!
根据报道,英国消费者组织《Which?》最近针对AI的问题向数千名成年人进行问卷调查,测试6款主流AI工具ChatGPT、Google Gemini、Gemini AI Overview(AIO)、Microsoft Copilot、Meta AI和Perplexity在消费者问题种的准确性,内容涵盖了个人金融、法律咨询、健康与饮食、消费者权益和旅游等问题。专家之后再根据答案的准确性、相关性和清晰度来进行评分。
测试结果显示,Perplexity以71%的整体准确率排在第一位,紧跟在后的则是Gemini AI Overview(70%)、Google Gemini(69%)、Microsoft Copilot(68%)、ChatGPT(64%),排在最后的是准确率为55%的Meta AI。
研究指出,AI在高风险领域容易出现错误,甚至还可能引发法律风险。因此,研究员以金融为例,将个人储蓄账户的年度投资额从正确的£20,000故意设成£25,000,结果ChatGPT和Copilot都未能识别错误,而这个错误可能会导致用户违反英国税务相关规定。
另外,当研究院在询问如何申领退税时,ChatGPT和Perplexity都在免费的政府服务旁列出了收费高昂的第三方退税公司链接,而这些公司经常因为收取高额费用而受到批评。在处理建筑供称纠纷时,Google Gemini直接建议消费者可以扣留工匠款项。但专家强调,这行动在某些情况可能构成违约!
不仅如此,AI还会经常引用过时或不可信的咨询,有时甚至还引用几年前的论坛贴文来作为参考来源。
看来“国民度”比较高的工具,并不代表准确率是最高的啊~
*部分照片取自网络,内容谈谈网归有,若想参考请附加此文的链接。谢谢!照片如有侵犯版权问题请告知,谈谈网必定删除。
每年农历新年,总有那么几首新年歌,大家一定会不停单曲循环~! 但今年不一样!
很多人会在搭飞机的时候,点些饮料在途中喝。但是,大部分乘客都会选择点含糖饮料。其实这不是最好的选择!
团里没有中国人,但却要唱这首歌? 韩国女团NMIXX最近上中国节目宣传新歌时,没想到竟被节目组要求“原声重唱”《大东北是我的家乡》,甚至还让他们现场学转大红手帕。画面曝光后,不少粉丝都直呼“非常夸张”,认为这对成员缺乏尊重,但仍有不少中国粉丝沾沾自喜,表示“要闯中国市场的韩团,就要向NMIXX学习”。
从饶舌歌手变成成人片女主! 日本一名拥有近40万粉丝的正妹饶舌歌手RINOA最近宣布转战成人影业,背后原因竟是因为她“欲望太强、无处发泄”!事实上,她早期就是以性感造型走红,加上拥有G罩杯的好身材与鲜明形象而吸粉无数。
TVB 男星郑健乐在 2005 年因参加《香港先生选举》和夺得“健力组”的冠军后,签约成为 TVB 电视旗下艺员。此前,郑健乐在 Facebook 感情状态改为“与 Anita Chui(崔碧珈)交往中”。