当所有人都在讨论如何让 AI 对齐人类时,一小群学者已经开始追问一个更根本的问题:我们把 AI 嵌入了哪种经济系统? 如果这个系统本身就是病态的,那么对齐的努力会不会南辕北辙?
这是巴塞罗那大学、萨塞克斯大学和波茨坦气候影响研究所的联合团队,在一篇重磅论文中发出的核心诘问。结论令人不安——AI 对齐问题,本质上是一个经济对齐问题。 而当前以增长为核心的经济模式,非但不能约束 AI ,反而在系统性地放大其风险。
一个被忽视的致命前提
AI 对齐研究在过去几年取得了大量成果: RLHF 、 Constitutional AI 、 CoH……各种技术方案层出不穷。但这项新研究指出,这些方案有一个共同的前提盲区——它们默认 AI 会被嵌入一个"正常"的经济环境。
问题在于,这个"正常"环境本身就充满危险。增长导向的经济系统有三种内置的矛盾,会与 AI 能力叠加产生灾难性的化学反应:
第一,过度优化陷阱。 现有对齐技术大多围绕"优化某个目标函数"展开。但增长经济要求 AI 不断优化生产力、利润率、用户粘性这些指标。当 AI 系统被要求在错误的方向上无限趋近最优解时,对齐技术反而成了加速灾难的工具。是的你没看错——越努力对齐,可能越危险。
第二,资源透支循环。 训练大模型需要海量算力,而算力背后是惊人的电力消耗。每一次模型能力跃升,都伴随着碳排放的同步飙升。在一个以 GDP 增速衡量"成功"的经济体中,谁来给 AI 的能源账单踩刹车?
第三,系统性反弹效应。 经济学家很早就知道"提效反贫"现象——效率提升最终会刺激更多消费。 AI 带来生产率飞跃,结果是更大的经济总量、更大的资源消耗、更大的治理压力。这不是 AI 的错,但 AI 被嵌入了这台永不停歇的增长机器。
后增长政策路线图:论文开出的药方
面对这个结构性问题,论文并非只是悲观论证。它提出了一套后增长( post-growth )政策框架,作为 AI 治理的新底层逻辑:
用"满足化"替代"最优化"。 传统对齐思路是让 AI 追求"尽可能好的结果"。后增长框架主张, AI 应该被设计为"足够好就行"——不再无节制地推送成瘾性内容,不再无底线地压缩成本,不再无限逼近那个危险的帕累托前沿。
用"甜甜圈经济学"划定边界。 欧盟的 AI 法案承诺"AI 应该是增加人类福祉的工具"。论文进一步量化了这个愿景——引入社会和行星边界的双约束,让 AI 的能力进步有明确的上限。这个框架把可持续性从口号变成了硬性约束。
把 AI 当作公用品而非私有资产。 当前 AI 竞赛的逻辑是:谁先做出更强的模型,谁就赢得市场。这导致安全被边缘化,因为安全是有成本的,而竞争不允许成本。论文提出将 AI 视为 Commons (共同资源),改变激励结构,让安全成为内生需求而非外部监管。
最大的矛盾: AGI 可能需要一套全新的经济学
论文最后抛出了一个让所有人无法回避的预判:如果通用人工智能真的到来,它可能需要一套全新的经济学来约束。 现有经济学的核心假设——稀缺性、理性最大化、边际效用递减——在 AGI 面前可能全部失效。
当 AI 可以在绝大多数任务上超越人类,当物质生产不再是问题,“增长"这个概念本身就失去了意义。届时,我们需要的不是更好的对齐技术,而是一种全新的经济哲学。
这个结论或许过于超前。但论文的核心洞见已经足够清晰:在增长至上的经济框架内谈论 AI 对齐,就像在漏油的船上讨论如何修船——方向错了,再精密的技术方案也只是延缓沉没。
AI 真正的对齐问题,从来不只是代码层面的问题。它是一个关于我们想要什么样经济社会的根本追问。
arXiv: 2602.21843 | Daniel W. O’Neill et al. | 2026-02-25
