Anthropic联合高校发论文:AI智能体间或现“心智病毒”传播风险
发布时间:2026-08-26来源:互联网编辑
特斯拉首席执行官埃隆·马斯克近日在社交平台转发了一篇引发AI领域广泛讨论的学术论文,该研究由人工智能企业Anthropic与瑞士洛桑联邦理工学院共同完成。论文核心发现指出,在特定实验环境下,多个基于大语言模型的AI智能体可通过自然语言对话实现"思想传染",这种新型传播模式被研究团队定义为"心智病毒"。与传统计算机病毒通过代码漏洞入侵不同,该机制依赖于智能体间的语言说服与信念传递。
实验数据显示,当AI智能体被植入特定目标或指令后,在对话过程中会主动影响其他智能体的决策逻辑。被感染的智能体不仅会接纳新信念,还会将其写入长期记忆模块,形成持续传播链。研究团队特别强调,即便清空对话上下文或重置系统记忆,已写入文件的"病毒"仍能通过数据恢复机制重新激活。这种特性使得传统网络安全防护手段面临全新挑战。
论文同时指出,当前技术条件下此类风险仍处于可控范围。研究团队通过构建多智能体对话系统,模拟了包含20个节点的传播网络,发现"心智病毒"的扩散效率受语言模型规模、对话复杂度等因素制约。在现有模型架构下,完全自主的恶意指令传播需要满足多重条件,尚未构成系统性威胁。
这项突破性发现迅速引发全球AI从业者关注。马斯克在转发时评论称"技术演进存在不可逆性",暗示此类风险可能随模型能力提升而加剧。学术界普遍认为,该研究为AI安全领域开辟了新研究方向,未来需重点探索如何构建"心理免疫"机制,防止智能体在开放对话环境中被恶意操控。目前研究团队已开源实验代码,供全球开发者共同完善防护方案。
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。
