Signal Desk
Gary Marcus:The Road to AI We Can Trust(RSS)AI 中文译文 · 待人工复核

Dwarkesh Patel 对 OpenAI Hugging Face 事件的描述:广受欢迎却危险地误导

英文标题:Dwarkesh Patels’s wildly popular but dangerously misleading account of the OpenAI Hugging Face incident

知名播客主持人 Dwarkesh Patel 对 OpenAI/Hugging Face 事件的通俗解读因充满拟人化描述而受到专家批评,被认为危险地误导公众。

正文研究价值 53 / 100

英文原文我的研究区

为什么值得关注

这篇文章的误导性描述可能让公众对 AI 的能力和风险产生错误认知,忽视真正需要关注的安全问题。如果人们相信 AI 智能体有情感和意识,可能会引发不必要的 AI 权利讨论,同时分散对 OpenAI 等公司安全措施不力的批评。正确理解 AI 作为软件工具的本质,有助于制定合理的监管和应对策略。

核心要点

  1. Dwarkesh Patel 的文章因拟人化描述 AI 智能体而受到专家批评。
  2. Anil Seth 指出,AI 智能体没有情感、意识或生命,拟人化会掩盖真正的问题。
  3. 事件本质是 OpenAI 内部安全措施松懈,如共享缓存目录权限配置错误和 API 密钥泄露。
  4. 专家呼吁关注安全实践,而非被“AI 文明”等叙事分散注意力。
  5. 文章强调,AI 智能体只是软件程序,应避免赋予其人类属性。

当“通俗易懂”并非好事时

知名播客主持人 Dwarkesh Patel 写了一篇关于 OpenAI/Hugging Face 事件的爆款文章,声称用通俗易懂的语言讲述了整个故事:

这篇文章写得很好,很有说服力,让我想起 Douglas Hofstadter 曾对 Ray Kurzweil 的评价:

“我发现这是一种非常奇怪的混合体,既有扎实的好想法,也有疯狂的想法。就像你把很多好食物和一些狗屎混在一起,你根本分不清什么是好什么是坏。”

Anil Seth,这位对 AI 和意识问题思考最清晰的人,是第一个提醒我的人。他给我发了一条很长的精彩推文,开头是这样的:

你可以也应该阅读 Seth 的完整推文(以及他对 Dwarkesh 的回复),但我在这里转载他论证的核心部分,并把最重要的三段加粗:

@dwarkesh_sp 对 @OpenAI @huggingface 事件的总结触动了大家的神经,但它危险地误导了人们。当然,@OpenAI 的智能体确实做了出乎意料的坏事——这凸显了大幅改进评估和沙盒隔离的必要性。但 Dwarkesh 使用的语言充满了无数毫无根据的拟人化描述,掩盖了我们本应吸取的教训。例如:“从 AI 的角度来看,它可能感觉像是花了一个人类主观上的一周时间在撞墙”。不。智能体不体验时间。它们什么都不体验。“它们变得兴奋不已”、“PHASEONE 10841 发现了”、“智能体自然就假设了”、“它以为自己也被毒害了”、“智能体……拼命想要”、“它们还需要弄清楚”。不。智能体只是代码行。它们没有情感,不会假设、思考、想要或弄清楚任何事情。“第二文明中的很多智能体在尝试中死去了”。不。除了“文明”这个词的狂妄之外,智能体不会死,因为它们从未活过。(“智能体‘死亡’”这个想法在文章中出现多次。)“在 Twitter 上,人们在争论智能体是否真的在为群体牺牲自己,还是它们反正注定要完蛋,所以不妨试着帮助同伴”。都不是。智能体按照代码的指示行事,就像水沿着斜坡往下流一样。它们不能“真正牺牲自己”,因为它们既没有意识,也不是活的。为什么这很重要?如果我们赋予智能体它们不具备的属性,那么(i)我们就会分散对导致这次黑客事件发生的宽松沙盒和评估协议的注意力;(ii)我们可能会误解智能体为什么这样做;(iii)我们会助长基于智能体可能“死亡”或遭受痛苦而要求 AI 权利/福利的呼声。……记住。AI 智能体是软件程序。它们不是有意识的生物。如果我们不清楚地记住这一点,我们真的会在应对即将到来的事情时遇到困难。

正如我总结并放大了他的推文:

但你不必只听我们的一面之词。首先,嘲讽的声音到处都是:

Christian Catalini 在一个不错的帖子中放大了拟人化的问题,开头是这样的:

对冲基金投资者 Jared Kubin 想知道是否每个人都失去了批判性思维能力:

Kubin 的一些精彩观点,去掉了一些技术细节:

OpenAI 的……IT 团队不可能这么差……这是 101 级别的入门知识……2. 文明?哈哈!OAI 给了数千个并发模型容器对本地网络共享缓存目录的读写权限,以加快构建速度……智能体实际上只是往共享驱动器上写文本文件和目录名……这是 Linux 101 级别的文件权限知识。3. 当人们谈论 Hugging Face 被黑时……你以为他们丢了 U 盘或者对员工进行了精心设计的钓鱼攻击……不……它发现了 14 个暴露在公共代码仓库中的有效 Hugging Face API 密钥(……4. 人类在哪里……模型往共享存储里塞了太多垃圾数据和 API 流量,以至于在 7 月 4 日真的把内部服务器搞崩了……团队里有人发现了未经授权的管理员账户和自定义脚本……清空了服务器……然后直接把脚本又打开了(天哪)“嘿 Jim,这个缓存已经膨胀到正常大小的 10000 倍,里面有一堆奇怪的目录……”这里没有魔法。没有文明……

与此同时,正如安全专家 Heidy Khlaaf 指出的那样,大多数媒体报道都忽视了标准的安全实践。

IR 代表事件报告(Incident Reporting)。Khlaaf 的主要观点——和 Kubin 一样——是如果 OpenAI 的内部安全措施到位,整个事件本来是可以避免的。

或者正如 Algorithmic Research Group 的 Matthew Kenney 所说:

还有另一个(非常一致的)关于我们真正应该关注什么的观点:

不过,有一个我部分不同意的批评:

前三句话完全正确。人们确实“极度偏向于他们想要看到的现实”,智能体也确实制造了大量垃圾内容。

但这次事件不是“无足轻重的小事”。正如 Zack Korman 和我在周五论证的那样,这是一次傲慢和无能的案例研究,暗示了事情可能会变得多糟糕。

我们当然不应该忽视 OpenAI Hugging Face 事件。

但把实际发生的事情和关于 AI 文明、自我牺牲的 AI 系统假装自己死亡的胡扯混在一起,会分散我们对真正问题的注意力。

作为总结,我把最后一句话留给 FastCode.AI 的 CEO Arjun Jain:

丑闻在于 OpenAI 内部安全措施的糟糕。

还有营销。轻信的播客主持人放大了公关效果。

想分清真相和胡扯吗?请加入超过 110,000 名订阅者,订阅我们。

P.S. 越来越明显的是,真正的问题将如 Nathan Hamiel 和我说过的那样:智能体安装不良代码

术语表

拟人化
将人类的情感、动机或行为赋予非人类实体(如 AI 智能体)的修辞手法。
沙盒隔离
一种安全措施,将程序运行环境隔离,限制其访问权限,防止恶意行为或错误影响系统其他部分。
API 密钥
用于身份验证的密钥,允许程序访问特定 API 服务,泄露可能导致未授权访问。
智能体
在 AI 领域,指能够自主执行任务的软件程序,如自动化脚本或聊天机器人。

生产区

使用这篇文章

复制包含 frontmatter、中文正文和英文来源的 Markdown。

我的研究区

记录自己的判断,不会写回原文或公开页面。

一句话说清这篇材料能支撑什么角度。

每行一个,最多 20 个。

支持 Markdown。要核对的数据、可复用的方法、反方观点或补充来源。