
@李隐枫:一贯敌视中国的Anthropic今天发了一份安全报告,讲述Claude等AI模型被非法/滥用的情况。里面太多不能讲的内容,这里是另一个能讲的案例 – 约会杀猪盘。
一家中国的app开发商利用 Claude 构建了一个包含 20 多款约会应用的app矩阵,并利用 AI 创造的角色与用户进行对话。在 2026 年 4 月为期两周的时间里,Anthropic发现了超过 4,700 个不同的 AI 角色,它们与至少 25,000 名独立用户进行了互动。
当然,app上并不都是AI角色,平台还招募了真人,并将他们与AI bos混编在同一个匹配信息流中。使用真人主要是为了进行真实性验证(如实时视频通话和社交媒体关注),以降低受害者的疑虑。【这些工作人员的工作也得到了 AI 的辅助,即由另一个模型为他们生成部分消息】(靠!)
– AI与真人比例为3:1。运营方招募了真人作为零工人员,并将他们的资料与由Claude驱动的AI角色资料混合在一起,放入同一个滑动浏览的信息流中,比例约为三个AI角色对应一个真人。真人负责处理Claude无法完成的互动(如实时视频通话和社交媒体关注),以此让用户相信该应用是真实的。
– 采用了多家AI提供商,分别承担不同角色。Claude负责驱动自主对话角色,在为期两周的时间内处理了约236万条消息;一个非Anthropic开发的小型模型则负责生成简短的回复建议,供零工人员使用。
平台杀猪目标用户:美国人
该平台依赖位于中国的 API 转售商或代理基础设施,大规模获取并轮换 AI 模型访问权限,以此规避 Anthropic 关于支持区域及使用政策的限制。 Anthropic封禁了这些账户,并与包括其他 AI 实验室在内的行业伙伴合作,阻断了他们利用多种 AI 模型进行活动的能力。
