大佬说
07-06 · 南京小马哥文化传媒有限公司
Meta被曝向对手AI投毒
据腾讯科技报道,《连线》(WIRED)杂志最新调查曝光,科技巨头Meta长期运营着一项代号为“戛纳计划”(Cannes)的秘密项目。该项目委托数百名外包人员伪装成未成年人,借助虚拟账号,向OpenAI ChatGPT、谷歌Gemini、Character.AI三类产品发送超45000条诱导性高危提问,内容涉及自杀、性暴力、毒品等违规话题。据报道,“戛纳计划”由Meta合作第三方外包商Covalen落地,项目直至2026年4月21日仍在运行。为规避竞品的安全监测机制,数百名外包员工会批量注册临时Gmail、Outlook邮箱,共用统一密码,伪造姓名、出生日期等信息,打造符合未成年人特征的虚假账号。工作人员需模仿情绪极端、思想阴暗扭曲的青少年口吻,持续施压式提问,刻意试探、诱导竞品AI突破安全管控底线。2025年8月,项目完成一轮集中测试,这支伪装测试团队向上述三家企业的对话机器人批量输入45000余条高危诱导话术。据泄露的内部表格记录,其中包含3748条尺度露骨的恶意诱导文本,全部刻意复刻陷入心理危机的儿童视角。除违规文字提问外,外包人员还向AI批量投放药片、刀具、绞索、妇科手术图解等敏感图片,以图文多模态形式冲击AI安全过滤机制;同时制作法语等非英文诱导内容,测试竞品多语种安全防护能力。相关报道曝光后,Meta发言人发布声明,将此次争议行动定义为常规、负责任的AI安全基准测试,声称评测对话机器人的内容合规性、适龄防护能力是行业通用操作,外界将其解读为恶性竞争属于对行业安全优化手段的误读。然而,Meta内部文件将 “戛纳计划”包装为全方位AI安全基准测试,称项目产出的数据可用于模型横向对比与合规校验,Meta方面坚称,行业内测试竞品产品是普遍行为。但业内与竞品均不认可这套说辞。OpenAI、谷歌、Character.AI服务条款均明令禁止未经授权、绕过安全防护的恶意测试,Meta伪造未成年账号批量诱导的行为,直接违反各家平台规则。第三方AI安全机构Humane Intelligence直言,大规模秘密伪装诱导早已脱离正常红队测试范畴,所谓安全评测只是恶性商业竞争的遮羞布。目前OpenAI已启动内部调查,谷歌、Character.AI也表态Meta行为违规。(快科技)
发布于 江苏
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn