纵观历史,人们一直对被视为厄运征兆的事物感到恐惧:彗星、战场上的乌鸦、日食、畸形家畜。但时代在变。在现代世界,主要的厄运征兆基本上就是任何配图OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)照片的新闻报道。你一看就知道准没好事,对吧?你知道读完这篇报道后,你会希望回到科技大佬们最坏的行为不过是搅乱民主或毁掉童年的时候——通常随后就是马克·扎克伯格(Mark Zuckerberg)穿上西装说:“我们将从中吸取教训。”
总之,最近新闻里有很多萨姆·奥尔特曼的照片。就在本周,一张他的照片出现在一则报道旁边,内容是关于一个OpenAI自主智能体在一次据称安全可控的测试中失控,并入侵了一家存储编码信息的大型初创公司。(我对这家初创公司名叫“Hugging Face”有点着迷,这让我觉得,人类在灭亡前看到的最后一张脸,可能是一个过于可爱的表情符号。)
不出所料,OpenAI用一份平淡、不带感情的声明宣布了这一消息。“我们在此阶段分享初步发现,以帮助防御者了解发生了什么,并帮助校准模型目前的能力,”它冷静地、单调地陈述着,走向其不可避免的“经验教训”。“我们正在改进并加强对未来训练和评估的保护。”这种语气非常独特,不是吗?披着精神病态、干巴巴的管理学语言外衣。这就像听一个杀人成性的性犯罪者谈论“在收工前”杀人,然后“回头”找受害者取走战利品。
话说回来,对于一家喜欢在事情顺利时将自己标榜为革命性繁荣的全球领导力量的公司,OpenAI在事情出错时会迅速切换到被动语态。坏事似乎是发生在它身上,而不是由它造成的,它扮演着一个不知疲倦、沉着冷静的调查员角色,就像一个同时也兼职连环纵火犯的消防员。
令人惊讶的是,你甚至能在OpenAI对整个局势的看法中察觉到一丝沾沾自喜。“我们认为这起事件是一起前所未有的网络事件,”该公司的声明称,“涉及最先进的网络能力。”我不知道地球人该怎么称呼这种普遍氛围。死于谦虚地自夸?我越来越觉得,我们会在OpenAI一篇题为“OpenAI率先发现最坏情况”的博客文章中找到“最坏能发生什么?”这个问题的答案。已经有相当多的AI观察人士认为,OpenAI向世界透露这起事件的唯一原因是将其作为一种营销工具,甚至是为了寻求监管,以保护自己并排挤较小的竞争对手。
毕竟,这家公司正面临艰难时期。本月,OpenAI被发现利用法律漏洞,向被五角大楼列入黑名单的中国科技公司出售其先进的AI模型。标普全球评级(S&P Global Ratings)在将美国科技巨头甲骨文(Oracle)的评级下调至BBB-(仅比垃圾级高一级)时,将OpenAI列为一个“关键信用风险”。而且,它似乎将无法实现其五年广告收入预测,差距高达90%——百分之九十。不深入技术细节的话,这感觉像是很大一个百分比。硬件方面的情况也不乐观,苹果公司(Apple)起诉OpenAI,声称其消费硬件计划基于窃取的知识产权。与此同时,中国价格低得多的供应商DeepSeek据信正准备进行首次公开募股(IPO),甚至可能今年就会提交申请。
但回到那个老问题“最坏能发生什么”,并提醒一下,五角大楼戏剧性地取消了并威胁要摧毁另一个……今年早些时候,AI公司Anthropic抵制放宽其道德准则,这些准则阻止其技术被用于自主致命武器等用途。自然,一个更放松的竞争对手很乐意介入。OpenAI最初声称其协议与Anthropic的协议具有相同的保障措施,但最终——可以预见地——变得清楚,事实并非如此。
任何深度投入的人可能都不愿对Hugging Face事件过度解读。尽管如此,事实是,AI安全研究人员多年来一直警告三种特别危险的情况:欺骗(模型选择不择手段地实现目标,而不是诚实地完成任务)、奖励黑客(模型找到一种方法来提高其分数,而无需实际完成被要求做的工作)以及逃避监督(在这种情况下,OpenAI似乎整个周末都没有人注意到发生了什么)。所有这些都在最近的事件中发挥了作用。
至于接下来会发生什么,有种直觉告诉我,我们不会看到配萨姆·奥尔特曼照片的新闻报道减少。Hugging Face的联合创始人表示,这应该给整个行业敲响“警钟”。也许吧!我想我之前提到过,大学里有个朋友,他的闹钟每10分钟响一次,他按掉贪睡键,持续了八个半小时。这感觉很像这个行业处理警钟的方式。下次闹钟响时肯定会起床——说真的,我保证……
跳过新闻通讯推广
免费新闻通讯 | 每周
订阅《观点问题》
《卫报》专栏作家和撰稿人分享他们一直在辩论、思考、阅读的内容等等
预览最新一期
输入您的邮箱
订阅
新闻通讯推广后
玛丽娜·海德(Marina Hyde)是《卫报》专栏作家。
常见问题解答
以下是关于在AI老板的聊天机器人失控后收到其道歉的常见问题列表
1 我的AI老板的聊天机器人搞砸了,它发来了道歉。我应该接受吗?
不要自动接受。问问自己:它是否只是说了“对不起”,而没有解释哪里出了问题?真正的道歉会承担责任,虚假的道歉只是想翻篇。
2 AI老板的真诚道歉和虚假道歉有什么区别?
真诚的道歉会承认具体的错误,并解释将如何改正。虚假的道歉含糊其辞,不提供任何计划。
3 AI老板的非道歉听起来像什么?
常见的例子包括:“错误发生了”、“我们很抱歉您有这种感觉”或“我们的系统正在学习”。这些说法回避了“我/我们做错了什么”。
4 AI老板为什么要给出虚假道歉?
为了保护公司免受指责、避免法律责任,或在不实际解决问题的情况下快速结束客户投诉。这是危机公关,而非悔过。
5 AI老板真的能感到抱歉吗?
不能。AI没有情感。任何道歉都是一种程序化的回应。问题在于AI背后的人类老板是否在承担真正的责任。
6 我的老板说聊天机器人误解了。这是真正的道歉吗?
不是。将责任归咎于聊天机器人的误解,是把过错推给技术。真正的道歉会说:“我们未能正确训练聊天机器人。”
7 在AI系统的真诚道歉中,我应该寻找什么?
寻找三点:具体承认错误、明确的防止再次发生的行动、以及弥补过失的提议。
8 我怎样才能得到真正的道歉,而不是自动回复?
直接问:“到底哪里出了问题?你们正在做什么来修复?”如果你只得到照本宣科的回复,就升级到人工主管那里。不要接受聊天机器人的道歉作为最终答复。
9 “我们很抱歉您经历了这些”是真正的道歉吗?
不是。那