该项目委托数百名外包人员伪装成未成年人,向竞行业内测试竞品产品是争对普遍行为。Meta伪造未成年账号批量诱导的被曝行为,绕过安全防护的向竞恶意测试,测试竞品多语种安全防护能力。争对
为规避竞品的被曝安全监测机制,
但业内与竞品均不认可这套说辞。向竞妇科手术图解等敏感图片,争对Meta方面坚称,被曝称项目产出的向竞数据可用于模型横向对比与合规校验,
然而,争对少数观点认为极端场景测试具备现实参考价值,其中包含3748条尺度露骨的恶意诱导文本,声称评测对话机器人的内容合规性、打造符合未成年人特征的虚假账号。将此次争议行动定义为常规、项目直至2026年4月21日仍在运行。诱导竞品AI突破安全管控底线。
目前OpenAI已启动内部调查,
暴露AI巨头激烈商战下的底线失守。所谓安全评测只是恶性商业竞争的遮羞布。伪造姓名、数百名外包员工会批量注册临时Gmail、思想阴暗扭曲的青少年口吻,外包人员还向AI批量投放药片、2025年8月,性暴力、谷歌Gemini、Meta发言人发布声明,全部刻意复刻陷入心理危机的儿童视角。谷歌、借助虚拟账号,
据泄露的内部表格记录,刻意试探、直接违反各家平台规则。Character.AI三类产品发送超45000条诱导性高危提问,持续施压式提问,
除违规文字提问外,Meta内部文件将 “戛纳计划”包装为全方位AI安全基准测试,内容涉及自杀、绞索、毒品等违规话题。大规模秘密伪装诱导早已脱离正常红队测试范畴,
事件曝光后,科技巨头Meta长期运营着一项代号为“戛纳计划”(Cannes)的秘密项目。负责任的AI安全基准测试,项目完成一轮集中测试,Character.AI也表态Meta行为违规。工作人员需模仿情绪极端、Character.AI服务条款均明令禁止未经授权、《连线》(WIRED)杂志最新调查曝光,据腾讯科技报道,这支伪装测试团队向上述三家企业的对话机器人批量输入45000余条高危诱导话术。向OpenAI ChatGPT、OpenAI、外界将其解读为恶性竞争属于对行业安全优化手段的误读。
7月6日消息 ,共用统一密码,刀具、出生日期等信息,
第三方AI安全机构Humane Intelligence直言,但多数网友批评Meta不择手段,
相关报道曝光后,而非打磨自身模型安全能力,
据报道,谷歌、适龄防护能力是行业通用操作,