“温水煮蛙”式文明崩塌:爱丁堡哲学家的累积性灭绝假说

“温水煮蛙”式文明崩塌:爱丁堡哲学家的累积性灭绝假说

Kasirzadeh认为,AI不会在一夜之间接管世界——它会缓慢掏空文明的韧性,直到某一天一切断裂。

一、我们在寻找错误的末日

AI安全对话有一个最爱的反派:超级智能系统在一次戏剧性行动中夺取控制权。回形针最大化器。失控的AGI。人类输掉游戏的决断时刻。但爱丁堡大学和艾伦图灵研究所的哲学家Atoosa Kasirzadeh认为,这种对单一灾难性事件的执念,正在蒙蔽我们对一条更可信的灭绝路径的视线——而它已经启动。

Kasirzadeh在Philosophical Studies上发表的论文引入了一个框架,将AI存在性风险分为两类。”决定性”假说是人人都在谈论的——超级智能系统在一次决断性打击中胜过人类。”累积性”假说是几乎没有人准备的。

二、累积性灭绝:不需要超级智能

累积性路径不需要超级智能,不需要单一失控系统,只需要我们已有的东西:许多AI系统部署在关键基础设施中,各自制造可控的问题,但随时间复合,直到系统韧性崩溃。

Kasirzadeh识别了三种AI驱动破坏累积的机制:

  • 局部因果性与系统性影响:单个AI失败——一个有偏见的招聘算法,一次错误的医疗诊断——看起来是孤立的。但它们在互联系统中产生涟漪。足够多的局部破坏,会触发任何单一失败无法单独触发的临界点。
  • 选择性基础设施连接性:AI系统嵌入金融、医疗、国防、能源和通信。它们不需要超级智能就能制造级联失败,只需要以可传播的方式出错。
  • 多向反馈回路:AI系统塑造社会、经济和政治结构,这些结构反过来塑造下一代AI系统。虚假信息侵蚀信任,信任削弱治理,治理不善产生更差的AI法规,法规缺失允许更有害的部署。每一轮循环都在收紧。

没有任何单一温度上升是致命的。但水已经在升温。

三、”MISTER”完美风暴场景

为了将抽象具象化,Kasirzadeh构建了”完美风暴MISTER”场景:AI驱动的操纵腐蚀公众信任;信息安全在AI驱动的攻击下侵蚀;监控以安全之名扩张;公民与机构之间的信任崩解;经济结构因AI集中财富和替代劳动力而失稳;权利保护因国家部署AI针对本国公民而弱化。

这些单独都不是存在性风险。但它们共同掏空了正常情况下能够吸收冲击的系统。然后到来的是”触发事件”——一次大陆级网络攻击、一场级联基础设施失败、一次地缘政治危机——削弱的系统无法恢复。触发事件不是崩溃的原因,它是落在干燥了数年的引火物上的那根火柴。

四、斯多葛的”记住你会死”:面向脆弱性的清醒

斯多葛哲学的核心实践之一是”memento mori”——记住你会死。这不是悲观主义,而是一种清醒:只有正视脆弱性,才能真正保护有价值的东西。Kasirzadeh的累积性假说正是对文明层面的”memento mori”:我们一直在为科幻式的戏剧性末日做准备,却忽视了文明正在被缓慢掏空的现实。

马可·奥勒留在《沉思录》中写道:”在你身上发生的一切,都是对宇宙而言自然的。”斯多葛不是被动接受,而是在接受的基础上做出理性应对。对AI风险而言,这意味着:承认累积性侵蚀已经在发生,然后设计制度来检测和修复它——不是等待一个可能永远不会到来的戏剧性时刻。

结语

Kasirzadeh的累积性假说是一面冷峻的镜子:AI对文明的最大威胁,也许不是某个超级智能的”暴起”,而是无数微小失败的缓慢复合。2026年国际AI安全报告指出,最紧迫的风险”可能不来自模型本身,而来自围绕它们构建的复杂系统”。这正是累积性假说的一句话总结。斯多葛的”memento mori”提醒我们:真正的智慧不在于预见戏剧性的末日,而在于察觉温水正在变热。

延伸阅读

  • Kasirzadeh, A., “Accumulative AI Existential Risk”, Philosophical Studies, 2026。
  • 国际AI安全报告2026,Yoshua Bengio主编,30国100余专家。
  • Axios调查,AI公司存在性风险修辞与实际行动的落差,2025年12月。
  • 马可·奥勒留,《沉思录》,关于脆弱性与清醒的章节。
© Copyright Notice
THE END
喜欢就支持一下吧
Likes12 Share
评论 Be the First to Comment

    No comments yet