聊天机器人扭曲新闻,甚至影响付费用户

为什么这很重要?如果聊天机器人甚至无法像Google那样准确检索新闻,就很难相信它们能够准确解读和引用这些新闻。这使得它们的回答内容,即使附有链接,也远不可靠。
自信地给出错误答案
研究人员指出,聊天机器人以“令人担忧的自信”给出了错误答案,极少对结果进行限定或承认知识盲区。例如,ChatGPT“从不拒绝回答问题”,尽管其200个回答中有134个是错误的。在所有八款工具中,Copilot是唯一拒绝回答问题多于回答问题的工具。
报告明确指出:“所有工具都始终更倾向于提供错误答案,而不是承认自身局限性。”
付费版本并不可靠
即使是像Grok-3 Search和Perplexity Pro这样的高级模型,虽然比免费版本更准确,但仍然自信地给出了错误答案。这让人质疑它们高昂订阅费用的价值。
报告解释说:“这种矛盾主要源于(这些机器人)倾向于提供明确但错误的答案,而不是直接拒绝回答问题。根本问题不仅在于聊天机器人的事实错误,还在于它们权威的对话语气,这使得用户难以区分准确和不准确的信息。”
报告补充道:“这种未经证实的自信给用户带来了可靠性和准确性的潜在危险幻觉。”
捏造链接
AI模型因幻觉问题而臭名昭著,但Tow研究发现,Gemini和Grok 3的幻觉最为频繁——超过一半时间如此。报告指出:“即使Grok正确识别了一篇文章,它也常常链接到捏造的URL。”这意味着Grok可能找到正确的标题和出版商,但随后制造出实际的文章链接。
西北大学的一项名为Generative AI in the Newsroom的倡议分析了Comscore流量数据,证实了这一模式。他们在2024年7月至11月的研究显示,ChatGPT在其回答中生成了205个失效URL。虽然出版物偶尔会删除文章,导致404错误,但研究人员指出,缺乏存档数据表明“该模型在回应用户查询时,幻觉出看似可信的权威新闻网站链接。”
鉴于AI搜索引擎的日益普及——Google在2024年第四季度市场份额首次跌破90%——这些发现令人担忧。该公司上周还为部分用户推出了AI Mode,用聊天机器人取代了常规搜索,尽管其AI Overviews广受批评。
每周约有4亿用户涌向ChatGPT,其引用的不可靠性和扭曲使它和其他流行AI工具可能成为虚假信息的引擎,即便它们从严格事实核查的新闻网站提取内容。
Tow报告得出结论,AI工具错误引用来源或错误呈现其内容可能会对出版商的声誉造成反噬。
无视被阻止的爬虫
Tow报告发现,情况对出版商而言更加恶化,几个聊天机器人仍然能够从使用Robots Exclusion Protocol(REP)或robots.txt阻止其爬虫的出版商那里检索文章。然而,矛盾的是,聊天机器人无法正确回答关于允许它们访问内容的网站的问题。
报告称:“Perplexity Pro在这方面表现最差,正确识别了近三分之一的九十篇它本不应访问的文章摘录。”
这表明,不仅AI公司仍在无视REP——正如Perplexity和其他公司去年被发现的那样——而且与它们有任何许可协议的出版商也无法保证被正确引用。
哥伦比亚的报告只是更大问题的一个症状。Generative AI in the Newsroom报告还发现,聊天机器人很少将流量引导到它们提取信息的新闻网站,其他报告也证实了这一点。从2024年7月至11月,Perplexity仅将7%的引流传递给新闻网站,而ChatGPT仅为3%。相比之下,AI工具倾向于偏好Scribd.com、Coursera和大学相关的教育资源,将高达30%的流量导向这些网站。
底线:原始报道仍然是比AI工具复述的更可靠的新闻来源。在接受它们提供的信息为事实之前,始终验证链接,并运用你的批判性思维和媒体素养技能来评估回答。
相关文章
美国股市触及历史里程碑,人工智能与航空航天巨头准备开启万亿美元时代
埃隆·马斯克、山姆·阿尔特曼和达里奥·阿莫迪,这三位科技领域的巨头,正推动其各自的企业迈向首次公开募股(IPO)。随着 SpaceX、OpenAI 和 Anthropic——这三家估值接近万亿美元的行业巨头——即将上市,2026 年被预测将成为美国历史上新股发行规模最大的一年。这一历史性的资本激增已引起全球金融界的关注,成为检验公共市场吸收如此大规模资金能力的关键压力测试。这些主要融资活动的同步启动预计将打破 2021 年创下的 1560 亿美元纪录。超级独角兽的资本博弈每家公司上市的路径
瑞典人工智能初创公司Lovable Eyes在完成主要融资轮后估值达132亿美元
随着人工智能驱动的编码工具日益普及,瑞典初创公司 Lovable 已获一轮重大融资。该公司计划筹集 30 亿美元,其估值有望升至 132 亿美元——这是去年 12 月记录的 66 亿美元的两倍。预计 Menlo Ventures 将主导此次投资。Lovable 的吸引力源于其核心的“氛围编码”(vibe coding)技术,该技术通过消除对复杂编码技能的需求来简化软件开发。用户只需以自然语言描述其需求,系统即可自动生成应用程序。这种直观的方法吸引了个人开发者、设计师和小企业,并扩展至 Work
Google 测试 Remy AI 代理,以 Gemini 为重点转向用户控制
根据《商业内幕》的报道,谷歌正在测试 Remy,这是 Gemini 的一款全新 AI 个人代理工具。该工具旨在代表用户执行任务,从而简化专业工作流程和日常事务。目前,Remy 正在 Gemini 应用的内部员工专属版本中进行测试。该报告引用了一份内部文件以及对两位熟悉该项目的个人的采访。内部资料将 Remy 描述为“全天候个人代理”,将 Gemini 定位为能够代表用户行事的主动助手。接近该项目的消息人士证实,谷歌员工正在积极测试 Remy。谷歌发言人拒绝提供进一步评论。该报告未提及公开发布
相关专题推荐
评论 (52)
0/500
Paying for premium AI news and still getting misinformation? That's like buying a fancy umbrella that leaks in the rain. 🤦♂️ This study just confirms my biggest fear about AI in journalism—it's not just about errors, it's about the confidence with which it spreads them. Makes you wonder if we're outsourcing our critical thinking to machines that can't even get basic facts straight.
Paying for premium AI chatbots and still getting fake news? That's a rip-off! 😡 This study just proves we can't trust these bots to get the facts straight.
프리미엄 버전을 구입했는데 뉴스 정확도가 형편없네요. confidently 잘못된 정보를 내뱉는 모습을 보면서 웃음이 나왔어요. 😂 돈 아깝네요. 사람 손으로 쓴 뉴스가 더 나을 것 같아요.
Paguei pela versão premium achando que teria notícias precisas, mas que erro! Ele dá informações erradas com tanta confiança que parece um pastor pregando. 😅 Não vale o dinheiro. Talvez seja melhor ficar com notícias escritas por humanos.

为什么这很重要?如果聊天机器人甚至无法像Google那样准确检索新闻,就很难相信它们能够准确解读和引用这些新闻。这使得它们的回答内容,即使附有链接,也远不可靠。
自信地给出错误答案
研究人员指出,聊天机器人以“令人担忧的自信”给出了错误答案,极少对结果进行限定或承认知识盲区。例如,ChatGPT“从不拒绝回答问题”,尽管其200个回答中有134个是错误的。在所有八款工具中,Copilot是唯一拒绝回答问题多于回答问题的工具。
报告明确指出:“所有工具都始终更倾向于提供错误答案,而不是承认自身局限性。”
付费版本并不可靠
即使是像Grok-3 Search和Perplexity Pro这样的高级模型,虽然比免费版本更准确,但仍然自信地给出了错误答案。这让人质疑它们高昂订阅费用的价值。
报告解释说:“这种矛盾主要源于(这些机器人)倾向于提供明确但错误的答案,而不是直接拒绝回答问题。根本问题不仅在于聊天机器人的事实错误,还在于它们权威的对话语气,这使得用户难以区分准确和不准确的信息。”
报告补充道:“这种未经证实的自信给用户带来了可靠性和准确性的潜在危险幻觉。”
捏造链接
AI模型因幻觉问题而臭名昭著,但Tow研究发现,Gemini和Grok 3的幻觉最为频繁——超过一半时间如此。报告指出:“即使Grok正确识别了一篇文章,它也常常链接到捏造的URL。”这意味着Grok可能找到正确的标题和出版商,但随后制造出实际的文章链接。
西北大学的一项名为Generative AI in the Newsroom的倡议分析了Comscore流量数据,证实了这一模式。他们在2024年7月至11月的研究显示,ChatGPT在其回答中生成了205个失效URL。虽然出版物偶尔会删除文章,导致404错误,但研究人员指出,缺乏存档数据表明“该模型在回应用户查询时,幻觉出看似可信的权威新闻网站链接。”
鉴于AI搜索引擎的日益普及——Google在2024年第四季度市场份额首次跌破90%——这些发现令人担忧。该公司上周还为部分用户推出了AI Mode,用聊天机器人取代了常规搜索,尽管其AI Overviews广受批评。
每周约有4亿用户涌向ChatGPT,其引用的不可靠性和扭曲使它和其他流行AI工具可能成为虚假信息的引擎,即便它们从严格事实核查的新闻网站提取内容。
Tow报告得出结论,AI工具错误引用来源或错误呈现其内容可能会对出版商的声誉造成反噬。
无视被阻止的爬虫
Tow报告发现,情况对出版商而言更加恶化,几个聊天机器人仍然能够从使用Robots Exclusion Protocol(REP)或robots.txt阻止其爬虫的出版商那里检索文章。然而,矛盾的是,聊天机器人无法正确回答关于允许它们访问内容的网站的问题。
报告称:“Perplexity Pro在这方面表现最差,正确识别了近三分之一的九十篇它本不应访问的文章摘录。”
这表明,不仅AI公司仍在无视REP——正如Perplexity和其他公司去年被发现的那样——而且与它们有任何许可协议的出版商也无法保证被正确引用。
哥伦比亚的报告只是更大问题的一个症状。Generative AI in the Newsroom报告还发现,聊天机器人很少将流量引导到它们提取信息的新闻网站,其他报告也证实了这一点。从2024年7月至11月,Perplexity仅将7%的引流传递给新闻网站,而ChatGPT仅为3%。相比之下,AI工具倾向于偏好Scribd.com、Coursera和大学相关的教育资源,将高达30%的流量导向这些网站。
底线:原始报道仍然是比AI工具复述的更可靠的新闻来源。在接受它们提供的信息为事实之前,始终验证链接,并运用你的批判性思维和媒体素养技能来评估回答。
美国股市触及历史里程碑,人工智能与航空航天巨头准备开启万亿美元时代
埃隆·马斯克、山姆·阿尔特曼和达里奥·阿莫迪,这三位科技领域的巨头,正推动其各自的企业迈向首次公开募股(IPO)。随着 SpaceX、OpenAI 和 Anthropic——这三家估值接近万亿美元的行业巨头——即将上市,2026 年被预测将成为美国历史上新股发行规模最大的一年。这一历史性的资本激增已引起全球金融界的关注,成为检验公共市场吸收如此大规模资金能力的关键压力测试。这些主要融资活动的同步启动预计将打破 2021 年创下的 1560 亿美元纪录。超级独角兽的资本博弈每家公司上市的路径
瑞典人工智能初创公司Lovable Eyes在完成主要融资轮后估值达132亿美元
随着人工智能驱动的编码工具日益普及,瑞典初创公司 Lovable 已获一轮重大融资。该公司计划筹集 30 亿美元,其估值有望升至 132 亿美元——这是去年 12 月记录的 66 亿美元的两倍。预计 Menlo Ventures 将主导此次投资。Lovable 的吸引力源于其核心的“氛围编码”(vibe coding)技术,该技术通过消除对复杂编码技能的需求来简化软件开发。用户只需以自然语言描述其需求,系统即可自动生成应用程序。这种直观的方法吸引了个人开发者、设计师和小企业,并扩展至 Work
Paying for premium AI news and still getting misinformation? That's like buying a fancy umbrella that leaks in the rain. 🤦♂️ This study just confirms my biggest fear about AI in journalism—it's not just about errors, it's about the confidence with which it spreads them. Makes you wonder if we're outsourcing our critical thinking to machines that can't even get basic facts straight.
Paying for premium AI chatbots and still getting fake news? That's a rip-off! 😡 This study just proves we can't trust these bots to get the facts straight.
프리미엄 버전을 구입했는데 뉴스 정확도가 형편없네요. confidently 잘못된 정보를 내뱉는 모습을 보면서 웃음이 나왔어요. 😂 돈 아깝네요. 사람 손으로 쓴 뉴스가 더 나을 것 같아요.
Paguei pela versão premium achando que teria notícias precisas, mas que erro! Ele dá informações erradas com tanta confiança que parece um pastor pregando. 😅 Não vale o dinheiro. Talvez seja melhor ficar com notícias escritas por humanos.





首页






