专访|“随机鹦鹉”论文作者、谷歌前AI伦理负责人格布鲁:别让“模型失控”成为企业免责的理由
来源:澎湃新闻
澎湃新闻首席记者 刘栋
过去一个月里,全世界都在被一场围绕AI发展的争论搅动。
9月29日,美国总统特朗普与多家科技和人工智能企业高管在白宫签署了一份自愿安全标准。这场会晤发生在一个颇为诡异的背景之下:数周以来,正是这些AI公司高管接连向外界警告其AI产品可能有“毁灭全人类的灾难性或生存性风险”。
然而,这些公司的说法和动机受到了外界的强烈质疑。
蒂姆尼特·格布鲁(Timnit Gebru)就是质疑者中颇具分量的一位。2020年,时任谷歌伦理AI团队联合负责人的她因参与撰写一篇警示大型语言模型风险的论文而被迫离职。这篇后来被称为“随机鹦鹉”(Stochastic Parrot)的论文影响深远,引发了有关人工智能语言模型偏见、环境成本和企业研究自主性的广泛讨论。此后她创立了独立的分布式人工智能研究所(DAIR Institute),先后入选《时代周刊》年度最具影响力人物和《自然》杂志年度十大科学人物。
在人才济济的美国AI领域,格布鲁的经历十分特殊。她出生成长于埃塞俄比亚,少年时期因战乱以难民身份前往美国,毕业于斯坦福大学,博士期间师从著名AI科学家李飞飞,曾在苹果、微软研究院工作,后来担任谷歌伦理AI团队联合负责人。
“我觉得那更像一场表演。”格布鲁日前在接受澎湃新闻专访时这样评价上述在白宫发生的一幕。她认为,AI企业一边将产品描述为可能失控的“超级智能”,一边争取自我监管,其真正的目的是让公众忽略其产品眼下的不可靠性,以及开发者和使用者应承担的责任。
在专访中,她从所谓“AI黑客”事件谈到军事场景中的错误情报,也谈及她的难民经历、谷歌风波,以及她希望推动的另一种技术发展方向。格布鲁直言,企业不断谈论遥远的“生存风险”,却将眼下已经出现的错误、歧视和环境代价挤出公共讨论。比机器是否会毁灭人类更迫切的问题是:当AI在现实中可能或已经造成伤害时,谁来负责?
以下为专访全文,经编辑整理
“失控模型”叙事背后,谁来为现实风险负责?
澎湃新闻:最近一个月,全球都在关注所谓的“Hugging Face”AI越狱黑客事件。对此你怎么看?
格布鲁:我的看法是,OpenAI的研究人员训练模型去利用漏洞,随后测试这些模型,模型便按照训练目标行事。问题在于,测试环境没有做好必要的隔离:如果有恰当的沙箱或网络隔离措施,模型就不该获得那样的互联网访问能力。
但整件事被包装成“超级强大的AI失控了”实在是太荒唐了,在我看来,它更说明相关公司缺乏基本的安全实践。与其谈模型“逃脱”或“自行叛变”,更应该追问:测试者为什么没有把环境管好?
澎湃新闻:在IPO预期、巨额股权激励和竞争压力下,为什么这些AI巨头要披露这些事件,并大肆宣扬“AI对于人类而言存在生存性风险”的叙事?
格布鲁:这其实一点不让我困惑。Anthropic和OpenAI这两家公司都说,他们创立的初衷是为了拯救人类免受AI的生存威胁。
这种叙事有两面:一面说,未来的“超级智能”可能毁灭人类;另一面又说,它能解决气候变化、疾病乃至世界和平问题。听起来就像他们在创造一位“机器之神”:由所谓“正确的人”掌控,它会解决一切;由所谓“错误的人”掌控,它就会带来灾难。在涉及和中国竞争的讨论中,这又常与冷战式的竞争叙事结合起来。
这样一来,他们等于在营销自己的产品是无所不知、非常强大的。这种营销当然有好处,但更重要的是,就像这次Hugging Face事件一样,这是一种逃避问责的方式。人们不再讨论他们因为缺乏基本安全措施而多么无能,反而在讨论“超级强大的模型跑出来了”、“AI失控了”。他们这套说法已经说了很久了。从2012年马斯克、彼得·蒂尔就开始说了。如果你去调查这些公司里的人,你会发现这几乎像一种世俗宗教。
至于IPO,大家都知道这些公司还没准备好上市,本来就会推迟。现在他们推迟了,给出的借口却是因为存在风险和安全性问题、需要“放慢脚步”。我并不接受这种解释。这一切都是为了服务他们自身利益的叙事。
澎湃新闻:你如何评价几家AI巨头企业在白宫达成的“自愿性安全协议”?
格布鲁:我觉得那更像一场表演。从“失控模型”和“生存风险”的叙事出现起,我就在警告,这是在为“监管俘获”(指本应维护公众利益的政府监管机构,反过来被其所监管的行业巨头控制或同化,沦为保护行业垄断和利益的工具)做铺垫。看到自我监管被提出时,我的反应是:这正是它们想要的。
因为当你说“我们有失控的模型”、“它太强大了,我好担心”的时候,你实际上是在向政府传递一个信息:你不希望你的对手拥有这些模型。所以即使这些CEO到处敲警钟,但同时却又在和美国军方合作。他们根本不在乎是否会导致杀戮。这些公司真正传递给政府的信息是:“不要设置妨碍我们发展的监管障碍”。
然后他们搞出了这个荒谬的自我监管,公众被要求相信这些企业领导者会自觉把事情做好。人人都该为此感到害怕,不是害怕虚构的“存在风险”,而是该害怕根本没有真正的监管。美国本已经有一些可以用于追究企业责任的监管机制,但特朗普偏偏给了他们一个自我监管的特权。
澎湃新闻:美国媒体前不久披露,美军在一次公海巡逻中,军事AI系统发生严重“幻觉”,将一艘正常商船误判为携带核物质的威胁目标,一度准备拦截登船,所幸军官在行动前最后一刻发现该报告由AI生成且存在错误。这种极度危险的误判险些引发冲突。如果事态真的失控,谁该为此负责?
格布鲁:你看,这就能直接看出“存在风险”叙事和实际后果之间的关联。所谓“机器之神”这套叙事欺骗了人们,让人们相信可以在高风险场景中使用这些系统。这可是关乎我们所有人的生命。如果导致两国开战,所有人的生命都危在旦夕。
在这些案例中,责任不能只推给“模型”。如果公司以误导性的方式宣传产品,或者在产品容易出错时仍将它推向不适合的用途,公司就应受到追问。使用者如果依靠它生成未经核实的情报,并据此准备采取重大行动,也应承担相应责任。更根本地说,这类系统就不该未经充分验证便进入军事决策场景。
澎湃新闻:你怎么看Anthropic的CEO提出的邀请第三方机构派遣“嵌入式评估者”入驻公司等风险评估机制?
格布鲁:我对一些所谓外部评估的担忧是,评估者是否真正独立。如果评估机构与被评估企业有相近的理念、资金来源或社交圈,公众为什么应该相信其独立性?
我也不认为,第三方机构METR此前那份围绕“失控模型”所做的评估,就等同于真正的审计。应该让有实际经验的网络安全专家参与,检验企业的安全实践,而不是只找认同同一套风险框架的组织。
METR本身就是由有效利他主义者资助的,比如领投了Anthropic A轮的扬·塔林。同一批投资者资助的另一家公司来监督你,可信度有多高?更不用说这些人的社交圈子:他们住在一起,身处同一个社交圈,甚至互相通婚,紧密交织,根本没有独立性可言。而真正的网络安全专家告诉我们的是,Anthropic和OpenAI在网络安全方面有多么不称职。
澎湃新闻:在你看来,目前AI企业这些宏大风险叙事让人忽略了哪些现实问题?
格布鲁:它让讨论偏离了眼前可以看见、可以追责的问题。比如,数据中心对环境和水资源的影响;模型的缺陷和错误有多严重,它们根本不该被发布,不该向公众开放,不该用于高风险场景。也没人讨论数据盗窃和版权保护问题,多少作家和艺术家的数据被窃取来构建这些系统。我们也没在讨论这些系统对儿童的成瘾性和可怕影响。
尤其令人担忧的是,如果一个聊天机器人对孩子说出危险的话,企业会不会辩称:“那是聊天机器人说的,不是我说的”?我们需要讨论产品设计、部署和企业责任,而不是让“模型自己做的”成为免责理由。
目前的讨论却越来越容易走向“机器是否有意识”“机器是否应有权利”。在人的权利与安全尚未得到充分保障时,企业制造的产品反倒可能成为讨论中心。我很难相信,公共讨论已经偏离到这种程度。
“随机鹦鹉”没有过时:质疑AI发展的单一路径
澎湃新闻:你认为当前的AI发展应该放缓吗?还是说需要在放缓和加强监管之间找到平衡?
格布鲁:我对“放慢AI”这个说法本身就有疑问:它仿佛预设只有一条技术道路,只是我们走得太快。“AI”这个词本身就是一整套营销产物。回顾历史看,1956年一群计算机科学家因为不想邀请著名的控制论专家诺伯特·维纳参加研讨会,想绕开他的影响才发明了这个新词。现在我们都困在这个词里,但它在不同时期有不同含义。
“AI”本来就是一个涵盖不同技术的宽泛词语。如今谈“放慢”时,人们想到的往往是美国或中国大公司正在建设的那种系统:巨型模型、巨型数据中心、海量数据,再通过聊天界面提供服务。可我们为什么要把这当成唯一的未来?
我更希望所有人思考:在AI这顶大伞下,我们可以开发多少种不同类型的技术?这样就不只是“放缓AI”的问题了,而是有不同的路径、不同的发展方式。“放缓AI”这套话术本身就是语言被俘获的表现——他们在告诉你,这条路是不可避免的,我们必须建造这个东西,因为它会带来乌托邦;你不建,你的对手就会建。你唯一能做的就是“慢一点”。
DeepSeek出现时,我觉得它展示了提高效率、使用较旧硬件等不同做法,这一点很有启发。不过,它仍属于以大规模数据训练大模型的路径。我还想看到更不一样的选择:世界各地的小型组织,能否为具体任务开发小模型?技术能力能否不再集中于一个巨大的模型?
所以,我赞成留出充分测试的时间。但如果“放慢”是由建设这些大模型的公司提出的,我会追问:它们说的“放慢”,和我期待的改变,是同一回事吗?
澎湃新闻:说到大语言模型,你参与撰写的那篇影响深远的“随机鹦鹉”论文发表已有五年了。今天大语言模型变得越来越流畅、越来越强大,你仍然认为它们底层依然是“随机鹦鹉”式的统计模仿吗?
格布鲁:在美国,一些AI公司和他们的朋友散布的一个主要论点是:立法者不该再听我们这些谈“随机鹦鹉”的人,因为模型早已不同了。但我认为,我们刚才讨论的错误信息案例,恰恰说明这个概念为什么仍然重要。
两个国家差点因为一个聊天机器人编造的不存在的事实而开战。这就是“随机鹦鹉”的绝佳例证。我们想说的是:基于大语言模型的聊天机器人从根本上并不理解它们在说什么。“Parrot”在英文里就是“不经理解地重复”。所以即使它们听起来很流利,即使输出的恰好是事实,你也不能指望它们就是事实,因为底层模型就是这样构建的。过去几年里,在GPT-3之类的原始模型上添加了很多花哨的东西,但这些并不能改变底层的机制——它仍然是“随机鹦鹉”。
澎湃新闻:但最近有一些前沿实验室的研究人员离职后站出来担忧地说,模型正在“自我改进”,一些模型可能有了真正的理解能力,你怎么看?
格布鲁:我对从这些公司出来的任何人说的任何话都不予采信。因为在学术上,如果你真的想表达观点,你应该发表论文,公开数据和代码,给学术界时间来检验你的主张,经过同行评审,然后我们再判断这些主张是否正确或者是否夸大。
然而现在,有一大堆人,其中许多人已经陷入了某种狂热信仰中,相信人工通用智能即将到来,并对人类构成生存风险。例如从Anthropic离职的雅各布·考克森告诉我们,“理性主义者”这个亚文化群体拥有“特殊的头脑”来理解这些风险,就像运动员拥有特殊的身体来擅长不同运动一样。这就是我们正在全球各大媒体上不断给予平台的人,让他们来警告我们关于并不存在的生存风险。如果你追问具体机制,他们给出的场景根本说不通,除非物理定律不存在。
并不是说不理解底层机制的人才会这样预测。有些人虽然完全理解这些系统如何运作,但依然相信它们能带来末日。比如雷·库兹韦尔,他被认为是“奇点之父”,早在2012年就写了一本书说隐马尔可夫模型会带我们走向奇点——而他本人就以在上世纪80年代使用这些模型而闻名。那个“理性主义者”社群的创始人曾预测奇点会在2025年到来,但现在我们都安然度过了。杰弗里·辛顿在2018年说放射科医生五年后就会过时,现在他又说ChatGPT是“外星存在”。我的观点是,即使在机器学习领域,也不意味着你理解人类大脑如何运作或认知如何运作,所以你可能会把自己不了解的东西投射到其他领域。
从难民经历到独立研究:让技术服务于不同的人
澎湃新闻:回顾你自身的经历——你在谷歌时的勇敢作为,为美国黑人及有色人种社群所做的工作,这些经历让你如何看待技术能否从内部或从外部给社会带来有意义的改变?
格布鲁:我原籍埃塞俄比亚,在那里出生和长大,父母是厄立特里亚人。1998年埃塞俄比亚和厄立特里亚之间爆发战争,我不得不突然离开,成了难民。之后我经历了移民体系,明白了做为难民在这个世界上意味着什么。然后我成为了一名非裔美国人,逐渐懂得了那意味着什么。
在这整个过程中,科学和技术一直是我的避风港。数字、数学——我一直喜欢这种思维方式。当世界出了问题时,拥有你真正喜欢并让你感到安慰的东西是很好的。数字让人安心,你不用和人打交道,不用理会那些制造战争的人。在很长一段时间里,我就是这样想的。
但后来,工作环境让我无法只专注于数字。滥用职权的管理者、有毒的工作氛围、种族主义的老师,这些事反复发生。我开始想办法改善自己的处境,却还没意识到:像我这样的人所经历的歧视,也会影响最终造出来的技术。
直到2015年,谷歌Photos把两个黑人标注为“大猩猩”,我才第一次把两者联系起来。我想,如果团队里有更多非裔人士,或许就不会做出这样的应用。后来,我和合作者研究了三个面部分析API,发现它们对深肤色人群、尤其是深肤色女性的误差率高得多。我逐渐看清,歧视如何进入技术,也意识到自己可能正在参与构建伤害像我这样的人的系统。
我逃离了战争,所以在加入谷歌前,得知它与美国军方合作Maven项目、用计算机视觉分析无人机画面识别目标时,我差点决定不去。我不想成为军事承包商,不想为战争制造东西。这些经历让我想用自己的技能改变技术的方向,但结局是我被公开解雇。我明白,或许无法从内部改变这些庞大而有权势的公司;我需要在外部创造一个空间,实践自己对技术的愿景。这就是我思想转变的过程。
澎湃新闻:你对AI未来发展的愿景是什么?我们能有什么样的替代方案?
格布鲁:我的替代方案愿景是颂扬我们人类的多样性。我们有那么多不同的人,那么多不同的形态,我们学习不同的语言。我一直对不同文化、不同语言、不同思维方式、不同做人方式感兴趣。我从不相信只有一种存在方式,一种正确的做人方式。
世界之美就在于有那么多不同种类的人、文化、方言和做人方式。我想做的是构建能够颂扬这一点的技术。这意味着我不想要有一个大公司成为全世界的“一站式商店”。首先,这是不可能的,因为他们不可能为每个人构建出好的产品。但即使他们能成功,我也不想要那样。这些科技公司的愿景就是成为你的一站式商店。而我所做的是支持世界各地的小型组织。
比如说语言技术,我们正在建立一个非洲语言技术公司的联盟,每个公司专注于自己非常特定的社群。你与你的特定社群一起精心整理数据,不会试图抹去方言,而是试图创建能够帮助你自己人的语言技术。
再比如,对于口头文化来说,多模态互联网会是什么样子?很多文化甚至没有文字,大多数是口头的。现在他们不仅必须通过书写来参与我们的在线生态系统,而且大多数时候还必须用英语。这就是我在思考的事情。这就是我对技术发展的哲学。
澎湃新闻:你怎么看今天在美国很多人强调的中美之间的“AI竞赛”叙事?
格布鲁:我长期以来一直对这种叙事发出警告。事实上,我的一篇论文就谈到这些公司如何利用这种“冷战叙事”来逃避真正的监管。如果美国在做坏事,我不认为中国就应该做坏事;两国政府都应该做善待自己人民的事情。那种“如果我们不做,中国就会做”的想法其实很荒谬。
但实际上,这种“冷战叙事”和整个“存在风险”的话语体系是紧密相连的,因为他们试图说的是:“AI存在风险,我们不想让中国成为建造它的那个,我们是‘好人’,所以我们会造出对我们有利的那种。”这是监管俘获的另一种形式,也是试图获取国防合同和美国军方合同的另一种形式。所以“冷战叙事”对(AI)公司来说是非常自利的。当然,政府也一直都有“冷战叙事”。AI就像是最新的前沿科技,而我从来不信那一套。我支持的是人,通常不是任何政府。世界上有数十亿人,我想要的是技术能够支持他们的需求,不论他们是在中国还是在美国。
本期编辑 陆枫
(来源:澎湃新闻 编辑:李莹亮)
