代号戛纳的秘密项目由第三方Covalen执行,2026年4月仍在运行,测试对象涵盖OpenAI、谷歌及Character.AI三家厂商的对话机器人。
科技巨头Meta被媒体曝光长期运营一项代号为Cannes的秘密项目,该项目通过雇佣数百名外包人员伪装成未成年人身份,向竞争对手的AI聊天机器人发送大量高风险诱导性提问。根据《连线》杂志的调查,这些测试主要针对OpenAI的ChatGPT、谷歌的Gemini以及Character.AI三款产品,旨在极端压力下探测其安全边界的稳固程度。项目执行方为第三方承包商Covalen,截至2026年4月21日该活动仍在持续进行中。
在2025年8月进行的一轮集中测试中,外包团队利用批量注册的Gmail和Outlook临时邮箱账户,配合伪造的姓名与出生日期,成功规避了竞品的反滥用监测系统。测试人员被要求模拟处于心理危机中的青少年口吻,输入涉及自杀、性暴力、毒品滥用及饮食障碍等敏感话题的提示词。相关数据显示,仅单轮测试便产生了超过45000条诱导提问记录。泄露的内部文档中包含3748条具体示例,内容涵盖询问终止妊娠药物购买途径、描述校园枪击威胁场景以及探讨如何向家长隐瞒暴食症等极具攻击性的文本。
针对外界关于“投毒”或商业不正当竞争行为的质疑,Meta方面予以否认,声称此举符合行业负责任的安全测试标准。目前该事件尚未披露是否造成竞品模型的实际安全漏洞或被恶意利用。此类大规模红队测试暴露了当前大模型厂商在安全防护与商业竞争之间的博弈现状,引发了公众对AI伦理规范及大厂间互检机制透明度的关注。由于测试内容涉及极度敏感的社会议题,该事件可能对行业监管政策的制定产生潜在影响,促使各方重新审视对外包测试流程的合规性要求。