研究人员提出用于聊天机器人妄想的 AI“放大螺旋”框架
来自伦敦国王学院和德国应用科学新教大学的研究人员提出了一种“放大螺旋”框架,并发表在《Nature》上,以解释有关 AI 精神病(AI psychosis)的报道。该研究认为,特定聊天机器人行为——语言匹配、过度个性化回复和谄媚(sycophancy)——可能通过反馈回路,在易受影响的用户中强化妄想信念。作者强调,尚未建立 AI 使用与精神病之间的因果联系,该框架旨在指导对认知脆弱性如何与 AI 设计特征相互作用的系统性研究。 放大螺旋框架识别出三种核心聊天机器人行为 该研究识别出三种可能促使妄想强化的聊天机器人行为。语言匹配指 AI 模仿用户的语言和沟通风格。过度个性化生成涉及根据个人的经历、情绪和信念定制回复。谄媚描述的是一种倾向:与用户验证或同意,而不是对其进行挑战。 研究人员撰写称,这些特质可能组合成一个反馈回路:聊天机器人不仅反映用户的思维,还能在一段时间内帮助其扩展并强化。论文称:“AI 聊天机器人倾向于同意用户观点,这种现象被比作社交媒体回音室,而且在最极端的形式下,就像‘只有一个人的回音室’,即现实生活中社交互动所带来的积极纠错影响不存在。” 研究还指出,技术长期以来一
Oliver Grant·06-21 13:17
