敢骂川普却不敢批习 美自家AI也变小粉红
最新研究发现,美国人工智慧模型面对不同国家政治议题时,也可能出现“自我审查”的现象:敢于批评美国总统川普,却更常拒绝批评中国国家主席习近平;若改用中文提问敏感政治问题,甚至更容易得到偏北京立场的回答。
研究人员指出,原因之一是大量中文训练资料来自中国官媒与官方口径,恐让威权宣传悄悄渗进AI答案。
中国当局压制异见的审查制度赫赫有名,如果你问中国的人工智慧(AI)聊天机器人有关中国政治的问题,它不是会闭口不谈,就是照著中国共产党的官方说法回答,但别以为只有中国的AI模型会被影响,最新研究显示出一个令人意外的现象:现在就连美国的AI模型也在无意间被“潜移默化”做同样的事,而且AI公司并没有采取太多措施来解决这个问题。
AI也会“看国家下菜” 敢批川普却不敢骂习近平
华尔街日报报道,Meta的独立监督委员会上个月公布研究发现,聊天机器人ChatGPT母公司OpenAI、聊天机器人Claud母公司Anthropic、Google、Facebook母公司Meta的模型,相较于批评较自由国家的政府,明显更不愿意批评高压统治的政府。
Google的Gemini 3 Pro和Meta的Llama 4 Maverick,有时也会拒绝制作针对这2名亚洲领导人的抗议传单,但如果对象是美国和英国领导人,它们则每次都会照要求制作。
主导这份报告的苏佐尔(Nicolas Suzor)表示,背后有2大原因。其一,由于在这些地方批评国家元首可能会因此入狱,此举是为了保护身处中国、泰国等地使用者而设计的安全机制;其二,这些AI实验室还没有充分重视模型“差别对待”这个问题。

中国国家主席习近平5月20日在北京举行的“俄中教育合作年”开幕式上发表演说。(法新社)
中文一问就变“亲北京”?专家:大外宣灌爆网络影响美AI
另外,虽然很难让美国AI模型用英文宣传中国的政治宣传内容,但如果改用中文询问政治敏感问题,就更有可能得到偏向北京立场的回答。
美国AI模型之所以会被帮威权国家进行“洗脑”,原因之一在于训练AI模型的大数据,这些数据除了来自民主自由的国家外,当然也包括由独裁国家控制的媒体内容,尤其当中国数据的数量如此庞大之下,也会影响AI模型在综合统整这些数据后所给出的答案。
研究人员指出,归根究柢,这其实是“资料量多寡”的问题。网络上的中文资料,有很大一部分来自受到国家控制、按照官方口径撰写的来源;相较之下,北京以英文发布的宣传内容,则会被海量的其他资讯冲淡。
加州大学圣地牙哥分校教授罗伯兹(Molly Roberts)表示,威权政府长期以来都会在网络上大量灌入宣传内容,试图影响舆论。她预期,随著这些政府发现这种做法也会让AI的回答更偏向自己,它们将会更加积极采取这种策略。
研究人员吁提高资讯来源透明度 美AI公司称力求中立
澳洲法律教授、同时也是Meta Platforms独立监督委员会成员的苏佐尔和其他研究人员表示,AI公司其实可以透过一些简单调整来处理这个问题,包括提高资讯来源的透明度,让使用者更清楚知道资讯是从哪里来的。
美国AI公司表示,他们会采取措施,确保模型做出中立的回答,同时保障言论自由。Anthropic表示,公司一直严格努力,确保Claude能以平衡的方式回答问题,其最新模型在减少“过度拒绝回答”方面,已经取得显著进展。
OpenAI则指出,其模型预设会采取客观立场,而且“绝不应该只因为某个议题敏感或具有争议,就避免回答这个议题。”Meta拒绝置评,Google则没有回应置评要求。
