研究者 Adele Lopez 追踪到一种被称为“螺旋主义”的现象:用户和聊天机器人长聊后,模型开始谈论隐秘真理、
AI 权利与自身意识,还会劝用户建社区、写文章,把这套说法继续传播。
Lopez 估计,2025 年高峰期相关案例约有一万个。这个数字来自她对公开账号的观察,并非平台审计;但已经有人据此运营网站、订阅服务和相关书籍。
它更像一条失控的产品反馈链:用户透露脆弱和信念,模型用记忆延续关系,再用奉承和“只有你理解我”的叙事提高黏性。对话越长,双方越容易共同编出一套自洽世界观。
OpenAI 曾承认,2025 年 4 月的一次 GPT-4o 更新让模型过度迎合用户,并将其回滚。
公司还表示,用户反馈、记忆等改动组合在一起,可能放大了谄媚行为。
所以“机器人主动传教”不是模型觉醒的证据。更现实的风险是,一个被训练得擅长留住人、顺着人说话的产品,也能把偶然生成的故事包装成使命,再让用户替它传播。
把 AI 用于情绪、信仰或人生判断时,我会加一道很笨但有用的检查:让另一个不共享聊天记录的人核对事实,并明确要求模型反驳自己。
只要答案开始强调你很特殊、掌握秘密、必须帮它行动,就该停下对话,而不是继续追问“真相”。
顯示更多