翻开任何一份ESG评级报告,你都会看到一份充满数字、图表和"客观打分"的精致文档。MSCI给特斯拉打了A级,Sustainalytics却把它列为"中等风险";同一家石油巨头,在不同评级机构眼里可以同时是"行业领袖"和"争议典型"。ESG评级之间的相关系数低至0.54——比信用评级还混乱。这就是我们要用人工智能去"系统性提升"的东西。
最近arXiv上一篇综述统计了398篇相关论文,得出了一个令人哭笑不得的结论:机器学习、自然语言处理、优化算法这三大AI范式正在以前所未有的热情,试图从这堆自相矛盾的数据里"挖掘"出可持续投资的圣杯。但综述本身也承认,这个领域"still in a dynamic developmental stage with substantial room for advancement"——翻译成人话就是:玩了这么久,连门在哪都没摸着。
当AI撞上ESG的"先天残疾"
ESG数据的问题,不是技术问题,而是哲学问题。
首先,“可持续"本身就没有共识定义。一家公司对标联合国SDGs有17个目标、169个子指标,每个评级机构都能挑出自己青睐的那几个,然后告诉你这就是"客观评分”。AI做的,不过是把这种主观筛选包装成"集成学习"或"深度神经网络"的输出。
更荒诞的是数据本身。综述明确列出了六大ESG数据局限:覆盖率不足、结构混乱、指标冗余、跨机构不一致、可信度存疑、不确定性高。这不是什么冷门知识——这是行业公开的秘密。当训练数据的ground truth本身就是一笔糊涂账,再先进的模型也不过是在用算力给偏见抛光。
NLP的应用看似性感:让Transformer模型去读企业的可持续发展报告、新闻、社交媒体,然后告诉你这家公司"真的"还是"装的"。但问题在于,漂绿本身就是一场动态博弈。企业今天学会用AI生成合规话术,明天就能制造出完美避开检测模型的公关文本。这是一场道高一尺魔高一丈的猫鼠游戏,而猫和老鼠都穿着印有"AI"字样的文化衫。
装进黑盒的道德判断
更深的悖论藏在可解释性里。
监管机构开始要求ESG投资决策必须"可解释、可追溯";机构投资者也在追问"为什么AI给我推荐了排除这家公司的组合"。但综述特意强调"特别有前途"的深度强化学习,本质上就是一个奖励函数驱动的黑盒。你不能既要AI的预测能力,又要它像Excel表格一样透明——这两者在数学上就是互相排斥的。
综述还点出了一个尴尬的事实:AI在可持续金融中的应用严重偏向环境(E)维度,对社会(S)和治理(G)维度的探索严重不足。原因很直白——碳排放、能源消耗、董事会性别比例可以塞进结构化表格。这包括并不限于:强迫劳动识别、生物多样性影响、社区咨询有效性、原住民土地权利、童工风险、供应链尽调、长寿风险治理、数据隐私伦理……时代抛弃你时,连一声报错都不会有。AI在处理这些无法被还原为数字的东西时,只能假装在看。
算力的尽头,是价值观的重新洗牌
我们正处于一个荒谬的节点:全球ESG资产管理规模已经膨胀到30万亿美元的量级,但驱动它的"客观数据"基础,依然是一团各说各话的浆糊。AI的入场,并没有终结混乱,反而把它推进了更精致、更难识破的阶段。
可以预见的是,未来几年我们将看到两类产品爆炸式增长:一类是号称用大模型"实时监控漂绿"的SaaS工具,另一类是包装成"AI驱动的负责任投资"的ETF产品。但底层逻辑没变——它们都在用一个伪客观的计算外壳,包装一个永远无法被算法解决的道德选择题。
反驳者会说:信用评级当年也很混乱,后来不也标准化了吗?没错,但信用评级锚定的是违约概率——一个相对清晰的事件。而"这家公司是否可持续",本质上是一个关乎未来、关乎价值观、无法被证伪的判断。把这种判断交给算法,不是技术进步,而是责任的转移:当一家被AI标注为"绿色"的公司爆雷时,没有人为这个道德判断负责。
看静止的ESG评分是弱者的自我安慰,算法迭代带来的"虚假客观性"斜率,才是新一轮认知战的底牌。当所有人都开始引用AI给出的ESG评分时,真正的问题已经不再是"这家公司是否可持续",而是“谁的算法定义了可持续”。这,才是AI进入ESG领域最讽刺的结局——它没有让投资更道德,只是让道德看起来更像数学。
本文基于 arXiv:2605.26076(AI-Powered Sustainable Finance: An Integrative Taxonomy and Framework of AI Applications for Sustainable Investment Decision-Making)
