据欧洲广播联盟(EBU)与BBC本周三发布的最新研究,当前领先的人工智能助手在近一半回答新闻相关问题时存在内容失实现象。该项国际研究评估了ChatGPT、Copilot、Gemini和Perplexity等AI助手,覆盖14种语言,共分析了3000个与新闻相关的提问和回应。数据显示,约45%的AI助手回答包含至少一个重大问题,81%的答复存在不同程度瑕疵。研究特别指出,在内容来源方面,大约三分之一的AI助手回应存在严重溯源错误,如缺失或错误标注新闻来源。其中,Gemini助手的信息溯源问题尤其突出,相关问题占其总回应的72%,而其他助手均低于25%。此外,所有AI助手总体有20%的答复存在准确性问题,包括使用过时信息等。
该研究还引用了牛津路透新闻研究院2025年数字新闻报告的数据,显示约7%的在线新闻用户、以及约15%的25岁以下用户会通过AI助手获取新闻。面对外界关注,各大科技公司均表示正致力于优化AI助手的信息准确性。Gemini在官网中表示欢迎用户反馈以持续改进;OpenAI与Microsoft则承认“幻觉”问题仍需解决;Perplexity则声称其“深度研究”模式在事实准确率方面可达93.9%。相关组织也已联系多家企业申请回应。研究指出,AI助手在分辨事实与观点、溯源新闻出处及保持信息准确方面仍面临重大挑战。
🔗 来源:CBC

发表回复