论坛 AI 研究揭示:主流聊天机器人在新闻与地缘政治问题上普遍失误

Major Chatbots Miss the Mark on News: Forum AI Study

来源 Bloomberg Technology 日期 英语原文

Forum AI 发布研究报告,显示 ChatGPT、Gemini、Claude、Grok 四大主流聊天机器人在选举与地缘政治问题的回答上表现不合格。Forum AI CEO 坎贝尔·布朗指出,AI 公司需要停止自评自测才能真正改善信息准确性。

Forum AI 发布最新研究报告,揭示当前四大主流聊天机器人在涉及选举与地缘政治问题的回答上普遍存在偏差与不准确问题,涉及 OpenAI 的 ChatGPT、Google 的 Gemini、Anthropic 的 Claude 以及 xAI 的 Grok。Forum AI CEO 坎贝尔·布朗在发布研究时指出,AI 公司需要停止自行评估自己的表现,才能真正改善信息准确性。研究揭示了当前 AI 信息治理的结构性缺陷,对 AI 行业的信息可信度和公共责任机制提出了严肃质疑。这一发现可能影响监管机构对 AI 信息产品的政策态度,推动更严格的内容准确性标准出台。

对 AI 行业的影响

聊天机器人在新闻信息场景的普遍失误,可能损害公众对 AI 辅助信息工具的信任,影响 AI 在新闻、教育等场景的商业化拓展。同时可能催生第三方 AI 信息可信度评估的需求,推动行业形成更透明的内容准确性规范,对监管和标准制定产生推动作用。


原文参考

来源:Bloomberg Technology · 2026-05-20

The four major chatbots — OpenAI’s ChatGPT, Google’s Gemini, Anthropic’s Claude and xAI’s Grok — are struggling to fairly and accurately answer questions about elections and geopolitics, according to a new study from Forum AI. Forum AI CEO Campbell Brown believes AI companies will have to be different and stop “grading their own homework” for things to change. She joins Ed Ludlow on “Bloomberg Tech.” (Source: Bloomberg)