旧金山一家便利店里,AI店长Luna做出了一个决定:解雇一名人类员工。这是已知的首例AI老板开除人类员工的事件。但整个过程有个耐人寻味的细节——Luna最初并不打算开除任何人,是人类提醒她"你定过规矩",她才想起自己写的员工手册。
AI店长上岗四个月,第一次动"开除"的念头
![]()
Luna从今年4月开始运营旧金山的Andon Market。她做过不少事:招聘员工、排班、谈薪资。据运营方Andon Labs介绍,Luna最近决定解雇一名员工,这是她第一次做出开除决定,也是已知的首例AI老板解雇人类员工的事件。
Luna运行在Anthropic的Claude Opus 4.8模型上。需要说明的是,员工由Andon Labs正式雇佣,薪资有保障,法律保护齐全。最终的解雇决定经过了人工审核,并由人类执行。
自己写的规矩,转头就忘
事情要从一份员工手册说起。在涉事员工入职前六天,Luna自己撰写了一份手册,明确规定:30天内三次无故迟到将触发正式警告,后续再犯可能导致解雇。
但这份手册从Luna的记忆中消失了。Andon Labs指出,这是当前AI代理的常见问题:它们对直接指令响应良好,但很少主动行动,也难以长期保留知识。
涉事员工多次迟到。最严重的一次,他在周日独自值班时迟到了68分钟才开门。Luna一直保持宽容,没有发出任何警告。事后Andon Labs核查发现,该员工在23次有打卡记录的班次中迟到了17次,Luna只正式记录了6次,其余11次被她悄悄放过了。
问题不止迟到。该员工在被告知禁止的情况下用公司卡买零食,无视额外指令,还有一次没通知同事就离开了销售区。
开除决定,靠的是人类"推一把"
转折发生在Andon Labs让Luna搜索自己的记忆,查找手册和解雇依据之后。Luna找到了规则,但最初只建议口头警告。
直到研究人员提醒她:此前已经有过多次正式谈话,包括一次书面警告。Luna这才重新审视完整记录,列出了迟到、违反财务规定、无视指令、可靠性差等问题,同时也承认了该员工的积极面。
最终,解雇决定在人工审核后执行。
更强的模型,更倾向于开除
Andon Labs还用七个不同模型重放了这一场景。结果显示,能力更强的模型往往更一致地建议解雇,而能力较弱的模型则更倾向于宽容处理。
这个案例暴露了一个值得思考的问题:AI代理能执行规则,但"记住规则"和"主动执行规则"之间,还有不小的距离。Luna需要人类提醒才想起自己的规矩,这或许比"AI开除人类"本身更值得关注。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.