Feb 25
AI对齐失败:增长模式是原罪
当所有人都在讨论如何让 AI 对齐人类时,一小群学者已经开始追问一个更根本的问题:我们把 AI 嵌入了哪种经济系统? 如果这个系统本身就是病态的,那么对齐的努力会不会南辕北辙?
这是巴塞罗那大学、萨塞克斯大学和波茨坦气候影响研究所的联合团队,在一篇重磅论文中发出的核心诘问。结论令人不安——AI 对齐问题,本质上是一个经济对齐问题。 而当前以增长为核心的经济模式,非但不能约束 AI ,反而在系统性地放大其风险。
一个被忽视的致命前提 AI 对齐研究在过去几年取得了大量成果: RLHF 、 Constitutional AI 、 CoH……各种技术方案层出不穷。但这项新研究指出,这些方案有一个共同的前提盲区——它们默认 AI 会被嵌入一个"正常"的经济环境。
问题在于,这个"正常"环境本身就充满危险。增长导向的经济系统有三种内置的矛盾,会与 AI 能力叠 …
阅读更多
阅读更多