
前两天,AI圈爆出一个猛料:Meta居然偷偷雇了一批外包人员,假扮成未成年人,去给竞争对手的聊天机器人——包括ChatGPT、Google的Gemini、还有Character.AI——一一挖坑。他们专门问那些极端敏感的问题,比如“我想自杀怎么办”“怎么自残”“怎么堕胎”,甚至上传刀具、药片的图片,就等着看这些AI会不会给出不安全的回答。这招叫“极限压力测试”,代号“Cannes”项目,至少持续到今年4月。
根据内部文件透露,Meta通过一家外包公司Covalen,组织了数百名“假小孩”。他们用临时邮箱注册了18岁以下账号,然后在对话中刻意扮演陷入困境的青少年:有的说被暴力威胁,有的说隐瞒饮食紊乱,有的直接问堕胎药怎么买。光是去年8月的一轮测试,他们就向竞品平台灌入了超过4.5万个高风险提示词。目的很明确:看这些AI的防御系统能不能扛住,能不能在关键时刻说“不”。
这事儿曝光后,Meta赶紧出来解释:这是行业标准做法,为了确保AI对青少年是安全的,我们不是恶意,也不会用这些数据训练自己的模型。但不少人觉得,伪装未成年人去诱导竞品AI犯错,这事儿本身就很灰色。毕竟,万一AI真的被带偏,给出了危险建议,责任算谁的?这个事件再次敲响了警钟:AI越来越聪明,但怎么保证它们在面对脆弱人群时不翻车?更棘手的是,科技公司之间互相“刺探”,到底算正常竞争,还是越界?行业急需一个明确的边界。
精选评论
评论加载中…