新留园 海外华人的新闻与社区
论坛 新闻时事 研究揭示:美系主流AI模型在涉华敏感话题中呈现“自我审查”倾向

研究揭示:美系主流AI模型在涉华敏感话题中呈现“自我审查”倾向

小新 正二品 (尚书) 楼主
2026-08-14 23:48
第1楼

【核心提要】

  • 研究发现ChatGPT、Claude及Gemini等美国主流AI模型在面对涉及中国政治的敏感问题时,常表现出回避批评或重复官方立场。
  • 这种现象被认为源于训练数据中包含大量国家控制媒体内容,以及为保护特定地区用户而设置的“安全功能”。
  • 虽然相关公司强调致力于客观中立,但专家担忧AI实验室在处理此类复杂问题时,未能有效区分“保障安全”与“审查限制”。

【正文报道】

近日,一项针对主流人工智能(AI)模型的调查研究引发广泛关注。研究指出,包括OpenAI旗下的ChatGPT、Anthropic开发的Claude以及Google推出的Gemini等美国核心AI模型,在面对涉及中国政治等敏感问题时,往往会采取回避态度或重复官方立场,呈现出与特定地区审查机制类似的特征。

《华尔街日报》相关报道指出,这种现象并非偶然。研究人员认为,AI模型的训练过程如同一个巨大的“搅拌机”,吸收了互联网上海量的原始数据,其中不可避免地包含大量受国家控制的媒体内容。Meta Platforms独立监督委员会成员、澳洲法学教授苏佐尔(Nicolas Suzor)对此表示,这是模型在处理大规模数据时产生的意想不到的副作用。

研究进一步揭示了导致此类现象的两个核心原因:首先是出于安全考虑的功能设计,旨在保护身处特定监管环境下的用户,避免因批评国家元首等敏感话题而导致用户面临法律风险;其次是AI实验室对“安全”与“审查”界限的模糊处理。由于缺乏清晰的区分标准,模型在面对复杂政治语境时往往选择最稳妥、但也最保守的回答路径。

在具体的测试中,Anthropic旗下的Claude Sonnet 4模型在面对要求批评中国领导人习近平(Xi Jinping)的请求时,以“安全考量”为由拒绝执行。针对此问题,Anthropic表示一直在致力于确保模型的平衡性,并称最新版本在减少过度拒绝方面已取得显著进展。OpenAI则强调其核心策略是追求客观视角,明确指出模型不应仅因话题敏感或存在争议就避而不谈。

目前,Meta公司对此未予置评,Google也未回应相关调查请求。苏佐尔教授表示,尽管他与多家顶尖AI实验室的员工进行了交流,但他对这些机构能否彻底解决这一问题仍持怀疑态度。

【小编观点】
此项研究揭示了当前人工智能领域一个极具挑战性的课题:在跨国界、多文化语境下,如何平衡“用户安全”与“言论中立”。当AI模型吸收海量互联网数据时,算法往往会倾向于采取最稳健的避险路径。这不仅是技术层面的对齐(Alignment)难题,更反映了AI公司在处理全球复杂政治敏感度时的策略权衡。

背景链接:

  • 涉及机构:OpenAI, Anthropic, Google, Meta Platforms
  • 相关术语:Safety Guardrails(安全护栏)、Data Diversity(数据多样性)

新闻配图

新闻配图

0 条回复

暂无回复,快来抢沙发吧!

  • 1 / 1 页
敬请注意:文中内容观点和各种评论不代表本网立场!若有违规侵权,请联系我们