AI模型失控谁来负责?企业不能拿技术当免责理由
|
过去一个月,一场关于人工智能发展方向的争论在全球范围内持续发酵。 9月29日,美国总统特朗普在白宫与多家科技及人工智能企业高管共同签署了一份自愿性安全标准。而这一会晤的背景颇为耐人寻味:数周以来,恰恰是这些AI企业的高管们不断对外发出警告,称其AI产品可能带来“毁灭全人类的灾难性或生存性风险”。 然而,这些公司的表态与动机遭到了外界的强烈质疑。 其中一位颇具分量的质疑者是蒂姆尼特·格布鲁(Timnit Gebru)。2020年,她作为谷歌伦理AI团队联合负责人,因参与撰写一篇警示大型语言模型风险的论文而被迫离开公司。这篇后来被称作“随机鹦鹉”(Stochastic Parrot)的论文产生了深远影响,引发了关于人工智能语言模型偏见、环境成本以及企业研究自主性的广泛讨论。此后,她创办了独立的分布式人工智能研究所(DAIR Institute),并先后入选《时代周刊》年度最具影响力人物和《自然》杂志年度十大科学人物。 在美国AI领域人才济济的环境中,格布鲁的经历显得格外特殊。她出生于埃塞俄比亚,少年时期因战乱以难民身份前往美国,毕业于斯坦福大学,博士期间师从著名AI科学家李飞飞,曾在苹果、微软研究院工作,后担任谷歌伦理AI团队联合负责人。 “我觉得那更像一场表演。”格布鲁日前接受澎湃新闻专访时,对白宫的那一幕作出了这样的评价。她认为,AI企业一方面将产品描述为可能失控的“超级智能”,另一方面又争取自我监管,其真正意图是让公众忽视其产品当前存在的不可靠性,以及开发者和使用者应当承担的责任。 在专访中,她从所谓的“AI黑客”事件谈到军事场景中的错误情报,也谈及自己的难民经历、谷歌风波,以及她希望推动的另一种技术发展方向。格布鲁直言,企业不断谈论遥远的“生存风险”,却将眼下已经出现的错误、歧视和环境代价排挤出公共讨论。比机器是否会毁灭人类更迫切的问题是:当AI在现实中可能或已经造成伤害时,谁来负责? 以下为专访全文,经编辑整理 “失控模型”叙事背后,谁来为现实风险负责? 澎湃新闻:最近一个月,全球都在关注所谓的“Hugging Face”AI越狱黑客事件。对此你怎么看? 格布鲁:我的看法是,OpenAI的研究人员训练模型去利用漏洞,随后测试这些模型,模型便按照训练目标行事。问题在于,测试环境没有做好必要的隔离:如果有恰当的沙箱或网络隔离措施,模型就不该获得那样的互联网访问能力。 但整件事被包装成“超级强大的AI失控了”实在是太荒唐了,在我看来,它更说明相关公司缺乏基本的安全实践。与其谈模型“逃脱”或“自行叛变”,更应该追问:测试者为什么没有把环境管好? 澎湃新闻:在IPO预期、巨额股权激励和竞争压力下,为什么这些AI巨头要披露这些事件,并大肆宣扬“AI对于人类而言存在生存性风险”的叙事? 格布鲁:这其实一点不让我困惑。Anthropic和OpenAI这两家公司都说,他们创立的初衷是为了拯救人类免受AI的生存威胁。 这种叙事有两面:一面说,未来的“超级智能”可能毁灭人类;另一面又说,它能解决气候变化、疾病乃至世界和平问题。听起来就像他们在创造一位“机器之神”:由所谓“正确的人”掌控,它会解决一切;由所谓“错误的人”掌控,它就会带来灾难。在涉及和中国竞争的讨论中,这又常与冷战式的竞争叙事结合起来。 这样一来,他们等于在营销自己的产品是无所不知、非常强大的。这种营销当然有好处,但更重要的是,就像这次Hugging Face事件一样,这是一种逃避问责的方式。人们不再讨论他们因为缺乏基本安全措施而多么无能,反而在讨论“超级强大的模型跑出来了”、“AI失控了”。他们这套说法已经说了很久了。从2012年马斯克、彼得·蒂尔就开始说了。如果你去调查这些公司里的人,你会发现这几乎像一种世俗宗教。 至于IPO,大家都知道这些公司还没准备好上市,本来就会推迟。现在他们推迟了,给出的借口却是因为存在风险和安全性问题、需要“放慢脚步”。我并不接受这种解释。这一切都是为了服务他们自身利益的叙事。 澎湃新闻:你如何评价几家AI巨头企业在白宫达成的“自愿性安全协议”? 格布鲁:我觉得那更像一场表演。从“失控模型”和“生存风险”的叙事出现起,我就在警告,这是在为“监管俘获”(指本应维护公众利益的政府监管机构,反过来被其所监管的行业巨头控制或同化,沦为保护行业垄断和利益的工具)做铺垫。看到自我监管被提出时,我的反应是:这正是它们想要的。 因为当你说“我们有失控的模型”、“它太强大了,我好担心”的时候,你实际上是在向政府传递一个信息:你不希望你的对手拥有这些模型。所以即使这些CEO到处敲警钟,但同时却又在和美国军方合作。他们根本不在乎是否会导致杀戮。这些公司真正传递给政府的信息是:“不要设置妨碍我们发展的监管障碍”。 然后他们搞出了这个荒谬的自我监管,公众被要求相信这些企业领导者会自觉把事情做好。人人都该为此感到害怕,不是害怕虚构的“存在风险”,而是该害怕根本没有真正的监管。美国本已经有一些可以用于追究企业责任的监管机制,但特朗普偏偏给了他们一个自我监管的特权。 澎湃新闻:美国媒体前不久披露,美军在一次公海巡逻中,军事AI系统发生严重“幻觉”,将一艘正常商船误判为携带核物质的威胁目标,一度准备拦截登船,所幸军官在行动前最后一刻发现该报告由AI生成且存在错误。这种极度危险的误判险些引发冲突。如果事态真的失控,谁该为此负责? 格布鲁:你看,这就能直接看出“存在风险”叙事和实际后果之间的关联。所谓“机器之神”这套叙事欺骗了人们,让人们相信可以在高风险场景中使用这些系统。这可是关乎我们所有人的生命。如果导致两国开战,所有人的生命都危在旦夕。 在这些案例中,责任不能只推给“模型”。如果公司以误导性的方式宣传产品,或者在产品容易出错时仍将它推向不适合的用途,公司就应受到追问。使用者如果依靠它生成未经核实的情报,并据此准备采取重大行动,也应承担相应责任。更根本地说,这类系统就不该未经充分验证便进入军事决策场景。 澎湃新闻:你怎么看Anthropic的CEO提出的邀请第三方机构派遣“嵌入式评估者”入驻公司等风险评估机制? 格布鲁:我对一些所谓外部评估的担忧是,评估者是否真正独立。如果评估机构与被评估企业有相近的理念、资金来源或社交圈,公众为什么应该相信其独立性? 我也不认为,第三方机构METR此前那份围绕“失控模型”所做的评估,就等同于真正的审计。应该让有实际经验的网络安全专家参与,检验企业的安全实践,而不是只找认同同一套风险框架的组织。 METR本身就是由有效利他主义者资助的,比如领投了Anthropic A轮的扬·塔林。同一批投资者资助的另一家公司来监督你,可信度有多高?更不用说这些人的社交圈子:他们住在一起,身处同一个社交圈,甚至互相通婚,紧密交织,根本没有独立性可言。而真正的网络安全专家告诉我们的是,Anthropic和OpenAI在网络安全方面有多么不称职。 澎湃新闻:在你看来,目前AI企业这些宏大风险叙事让人忽略了哪些现实问题? 格布鲁:它让讨论偏离了眼前可以看见、可以追责的问题。比如,数据中心对环境和水资源的影响;模型的缺陷和错误有多严重,它 |
论坛热帖
在线投稿
-
相关阅读
-
摄影师吐槽周子瑜身材引众怒 店铺遭差评轰炸
-
欧洲能源补贴为何难以扩大规模
-
微软Xbox高管被曝不喜欢二次元 导致放弃动漫改编游戏
-
白宫官员任命引猜测 美预测市场再曝内幕交易疑云
-
公募投资迎来关键调整 股指期货和国债投资堵点打通
-
应健中:上市公司三季报成市场关注焦点
-
瑞银预测黄金价格走势:12月或达4600美元,2027年9月上看5400美元
-
Anthropic账本曝光 IPO后谁才是最大赢家
-
精彩图片
-
魔兽公会模拟器上线:单机玩MMO,建设副本管理成员
-
《黑悟空》光盘销量破4万份,当地力挺游科和国产IP
-
印度3A游戏遭玩家差评,“摸头闪避”操作太难引吐槽
-
解压回收:废品干出黄金,爽到昏厥!
-
PS5数字版游戏买后无法玩?DRM验证卡半小时解决方法
-
《光环》新作主线时长8-12小时 全成就需20小时内
-
《最终幻想共鸣》三档难度自由切换 新手也能轻松上手
-
养只金毛花掉一套房首付?揭秘顶级血统犬背后的“割韭菜”套路
-
新帖速递
-
摄影师吐槽周子瑜身材引众怒 店铺遭差评轰炸
-
欧洲能源补贴为何难以扩大规模
-
微软Xbox高管被曝不喜欢二次元 导致放弃动漫改编游戏
-
白宫官员任命引猜测 美预测市场再曝内幕交易疑云
-
公募投资迎来关键调整 股指期货和国债投资堵点打通
-
应健中:上市公司三季报成市场关注焦点
-
瑞银预测黄金价格走势:12月或达4600美元,2027年9月上看5400美元
-
Anthropic账本曝光 IPO后谁才是最大赢家

精彩评论文明上网理性发言,请遵守评论服务协议
共0条评论