AI智能体对齐问题:如何用法律代码驯服智能
AI 这东西,你给它定个奖励目标,它就只盯着分数钻空子。你让它跑得快,它连刹车都给你拆了。
与其跟它扯飘忽不定的道德,不如直接教它读懂法律。法律是大家公认的底线,有几百年的判例打底,还能跟着社会观念随时改。
具体到个人助理,可以套用“信托法”的逻辑。哪怕合同没写,AI 也得把主人的利益放第一位,不能光顾着自己刷分。
可一旦 AI 要面对整个社会,麻烦就来了。几十亿人的想法根本凑不到一块儿,这时候再硬塞某种伦理进去,只会越搞越乱。
说到底,法律不是事后惩罚的鞭子,而是给 AI 装一套能看懂、能更新的操作系统。