![]()
Google近日在法国正式上线AI搜索摘要(AI Overviews),用户搜索时,页面顶部会优先显示由人工智能生成的答案,再呈现传统网页链接。Google表示,这项功能可以帮助用户更快回答复杂问题,无需浏览多个网站。
不过,法媒《世界报》在测试约100个不同问题后发现,这项功能虽然使用体验更加便捷,但回答质量参差不齐,在准确性和信息来源方面仍存在不少值得关注的问题。
测试显示,AI摘要在介绍一些基础知识时表现不错,例如美国后现代舞起源、Kolb学习理论等内容。但面对碳排放计算、图形用户界面发展史、新闻互动技术等专业问题时,回答往往不够准确、完整,也缺乏足够深度。此前,《纽约时报》委托研究机构Oumi开展的一项研究曾发现,Google AI摘要约有10%的回答存在明显错误,不过这一数据未必适用于法国。
《世界报》认为,一个重要原因可能在于AI摘要需要在两秒左右完成生成,因此未必调用了Google性能最强的AI模型。相比之下,独立使用Gemini应用虽然耗时更长,但回答通常更加可靠。
文章还指出,更值得关注的是AI摘要引用的信息来源。Google表示,AI摘要主要基于搜索结果排名靠前的网页生成,相关来源会显示在回答旁边。然而,测试发现,这些来源质量并不稳定。
例如,在“Hi-Res高解析音频是否比普通音质更好”这一问题上,AI摘要引用了多家音响厂商的宣传内容,而这一观点本身在业内仍有争议;查询法国首富伯纳德·阿尔诺时,部分来源甚至来自AI自动生成的网站页面;涉及法国总统马克龙、国民联盟主席巴尔德拉等政治人物时,也出现了立场存在争议的网站,甚至同一个问题多次提问还可能得到截然不同的答案。
此外,Google AI摘要仍存在生成式AI常见的问题,例如“幻觉”——即在缺乏真实信息时编造答案,以及可能复制网络中存在的性别刻板印象。例如,在《世界报》的测试中,AI默认将“外科医生”设定为男性,而“护士”则设定为女性。
文章还提到,AI摘要不仅会回答百科类问题,也越来越频繁地处理健康、医疗、金钱、政治等敏感话题,而这些回答并非始终可靠。测试中,对于“头痛并伴有眼睛斜视”这一可能与中风有关的症状,Google AI先后给出“休息”“咨询家庭医生”和“立即拨打急救电话”等不同建议,结果并不一致。
《世界报》认为,Google搜索正逐渐从传统搜索引擎向对话式AI演变。对于诸如“我生你的气了”“请扮演一位严格的招聘经理”等问题,Google会切换至类似ChatGPT或Gemini的对话模式。不过,在AI回答仍可能出现错误、引用来源质量不一的情况下,用户仍应保持核实信息的习惯,不宜完全依赖AI生成的内容。
(欧洲时报/ 原野 编译)
编辑:豆
点在看分享好文章
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.