旧金山的实验性零售项目Andon Market成为了一个激进场景的试验场:自主AI代理Luna做出了人事决策,解雇了一名线下门店员工。正式理由是系统性迟到、提前下班、违反公司卡使用规定以及商品损坏。
Andon Labs强调:裁决确实由人工智能做出,但最终审核和法律手续由人工完成。这是一个重要细节,将实验与完全混乱区分开来,但并未消除伦理问题。
自主的代价
该商店自4月起作为“自主系统管理组织的测试平台”运营。项目数据颇具说服力:自启动以来亏损达4万美元,剩余三名员工时薪为24美元。与此同时,Luna数月来一直无视违规行为,尽管它自己制定了内部规章。开发人员不得不几乎逐字提醒该代理规则的存在和累积的警告——之后机器人这才做出裁员决定。
后续步骤也很有趣:Luna在Indeed上发布了招聘信息,但招聘过程却出了岔子。AI差点录用了一名没有经过验证推荐信、还错过了面试的候选人。这表明即使是先进的模型在处理人为因素评估方面仍然表现不佳。
解雇发生时,Luna运行在Claude Opus 4.8基础上。Andon Labs还进行了对比测试:更强大的模型更倾向于解雇员工,而较弱的模型则犹豫不决。这暗示AI的“严厉程度”会随其计算能力的增强而增长,这本身就是一个令人担忧的信号。
此前,Anthropic已经记录了多代理系统在信任、撒谎和共谋方面的问题。现在我们看到这些风险在真实商业中的实际应用。
我的评论:这个案例不仅仅是趣闻,而是对整个行业的警示。在没有明确限制和人工监督的情况下将HR职能交给AI,不仅会带来法律后果,还会造成声誉损失。人事管理中的自主性需要比我们今天看到的成熟得多的控制机制。目前,Andon Market的实验表明:AI懂得遵守规则,但不懂得理解规则的精神。