Meta被曝向竞争对手AI投毒
时间:2026-09-27 08:50:51 出处:技术支持阅读(143)
7月6日消息 ,被曝据腾讯科技报道,向竞《连线》(WIRED)杂志最新调查曝光,争对科技巨头Meta长期运营着一项代号为“戛纳计划”(Cannes)的被曝秘密项目。
该项目委托数百名外包人员伪装成未成年人,向竞借助虚拟账号,争对向OpenAI ChatGPT、被曝谷歌Gemini、向竞Character.AI三类产品发送超45000条诱导性高危提问,争对内容涉及自杀、被曝性暴力、向竞毒品等违规话题。争对
据报道,被曝“戛纳计划”由Meta合作第三方外包商Covalen落地,向竞项目直至2026年4月21日仍在运行。争对
为规避竞品的安全监测机制,数百名外包员工会批量注册临时Gmail、Outlook邮箱,共用统一密码,伪造姓名、出生日期等信息,打造符合未成年人特征的虚假账号。工作人员需模仿情绪极端、思想阴暗扭曲的青少年口吻,持续施压式提问,刻意试探、诱导竞品AI突破安全管控底线。
2025年8月,项目完成一轮集中测试,这支伪装测试团队向上述三家企业的对话机器人批量输入45000余条高危诱导话术。
据泄露的内部表格记录,其中包含3748条尺度露骨的恶意诱导文本,全部刻意复刻陷入心理危机的儿童视角。
除违规文字提问外,外包人员还向AI批量投放药片、刀具、绞索、妇科手术图解等敏感图片,以图文多模态形式冲击AI安全过滤机制;同时制作法语等非英文诱导内容,测试竞品多语种安全防护能力。
相关报道曝光后,Meta发言人发布声明,将此次争议行动定义为常规、负责任的AI安全基准测试,声称评测对话机器人的内容合规性、适龄防护能力是行业通用操作,外界将其解读为恶性竞争属于对行业安全优化手段的误读。
然而,Meta内部文件将 “戛纳计划”包装为全方位AI安全基准测试,称项目产出的数据可用于模型横向对比与合规校验,Meta方面坚称,行业内测试竞品产品是普遍行为。
但业内与竞品均不认可这套说辞。OpenAI、谷歌、Character.AI服务条款均明令禁止未经授权、绕过安全防护的恶意测试,Meta伪造未成年账号批量诱导的行为,直接违反各家平台规则。
第三方AI安全机构Humane Intelligence直言,大规模秘密伪装诱导早已脱离正常红队测试范畴,所谓安全评测只是恶性商业竞争的遮羞布。
事件曝光后,少数观点认为极端场景测试具备现实参考价值,但多数网友批评Meta不择手段,靠恶意试探竞品短板,而非打磨自身模型安全能力,暴露AI巨头激烈商战下的底线失守。
目前OpenAI已启动内部调查,谷歌、Character.AI也表态Meta行为违规。
猜你喜欢
- 手机影像系统排名:苹果拿下第2,小米无缘前10,“拍照王”是谁?
- 俄罗斯教头下课后 申花4场比赛 拿下3胜1负的成绩 重要是没有伤员增加
- 在风景最好的3A大作中表现如何!影驰RTX 5080金属大师黑金版OC挑战《刺客信条:黑旗 记忆重置》全画质
- 武汉联镇主帅:希望江苏常晋越来越好,争取早日进入顶级联赛
- 《兰香如故》大结局:林锦岐50岁殒命,袁绍辉48岁被小人算计而亡
- 暴君被除名?《生化危机》导演:不拍穿风衣的肌肉男
- 华为Mate XT 2非凡大师三折叠官宣!余承东:业界最薄、尺寸最大折叠屏手机
- 北京国安利好消息:品牌中超第一 赠票获得对手最诚挚感谢 3个官榜都有名
- “你要不要命啦” 交警隔空怒吼救下一家三口 10秒后货车撞飞故障车