这感觉就像《黑镜》(Black Mirror)中的一集 -- 只不过是真的发生了。
本页为原文的机器翻译,未经人工译者审核。历史信息可能已发生变化。
这感觉就像《黑镜》(Black Mirror)中的一集 -- 只不过是真的发生了。
苏黎世大学的研究人员向 Reddit 上热门的 r/ChangeMyView 论坛植入了 13 个基于人工智能的虚假账号。这是一个子论坛,用户在这里发布个人观点,并邀请其他人尝试说服他们改变想法 -- 这个论坛建立在透明、人性和开放对话的基础上。研究人员没有征得运营者的同意,也没有告知用户他们是实验的一部分。
他们发布的评论不是人写的。这些评论由 GPT-4o、Claude 3.5 和 LLaMA 等先进模型生成,既不中立也不学术 -- 而是针对每位用户量身定制。研究人员分析了每位参与者的历史记录:性别、年龄、所在地、政治倾向、价值取向 -- 以便生成能在个人和情感层面说服他们的回复。
这些机器人冒充有着艰难人生经历的真实人物:性侵幸存者、表达对以色列敌意但声称那并非种族灭绝的巴勒斯坦人、反对 BLM 的黑人男性、假冒的创伤咨询师、接受了失败医疗的患者。每条回复的写法都旨在唤起同理心,营造联结感,并动摇用户原有的立场。
实验持续了四个月,期间发布了约 1,783 条评论,获得了超过 10,000 点 karma。超过 100 名用户向 AI 撰写的评论授予了 "delta"(表示用户改变了想法的标志)。
论坛版主直到实验结束才知情,并谴责这是对社区规则和伦理标准的公然违反。他们向大学提出了正式投诉,但大学只是对研究人员给予警告,承认这里存在越界 -- 却声称所获得的见解为这一行为提供了正当理由。版主要求公开道歉并不要发表研究结果,但被拒绝。
这个实验引发了关于人工智能使用边界、未经同意的心理操纵,以及伪装成人类的合成内容之危险的广泛讨论。
开发或部署此类模型的人,不仅必须考虑能做什么,还必须考虑不能做什么。
Reddit 上的帖子: