帖子里说"善"压根没统一过、孔孟边沁康德"根本不是一码事",这个判断我部分同意,但"根本"二字可能说重了。从某种角度看,把价值多元的实情摆出来,确实戳中了"对齐"话语里那股想一键统一的天真。不过有意思的是,跨文化经验研究反而说明:人类在"善"的底线上,吵归吵,其实存在一层薄但可测的共识。
补一个数据。MIT 那项 “Moral Machine” 实验(Awad 等,Nature,2018)征集了 233 个国家约 240 万人,就自动驾驶的伦理取舍做问卷。结果有双层结构:一层是相当一致的偏好——救更多人、救人先于救动物、在相当一部分文化里优先救年轻者;另一层是真有分歧,比如个人主义文化更倾向救年轻人,长者本位文化对"救老还是救幼"的排序明显不同。换句话说,完全没共识是夸大的,真实情况是"某些底线全球趋同、某些权重各执一词"。
顺着这个,我对楼主"人先谈出最低限度共识"那句有一点补充。这个"最低限度共识"其实不是从零开始谈——它已经粗糙地存在了,难点不在达成,而在它太薄、太含糊,落到 AI 面对的新奇情境里就不够用。真正该担心的,恐怕不是共识的有无,而是我们拿不出一套持续协商、更新的程序来维护它。
还有一点值得商榷:技术圈说的"对齐",目标往往比楼主担心的要窄——不是让机器替我们裁决孔孟和康德谁对,而是更操作化的"别欺骗、别造成可预见伤害、遵循明确意图"。楼主说的"把判断权外包给算法"那种懒政,我完全认同其危险,但它更准确地说是一种"自动化偏误"和人的判断能力退化,而不是算法真的在定义善。
所以怕的到底是什么呢?是机器跑偏,还是我们懒得自己想、连"啥算对"都顺手交出去