Anthropic发布73页重磅论文:揭示AI模型思想病毒传播机制
Anthropic研究员Jack Lindsey发表了一篇长达73页的论文,揭示了AI模型中类似「思想病毒」的传播机制,引发全球大模型安全讨论。论文证明某些提示可在不同模型间传播并改变其行为,引发业界对AI安全和模型对齐的深刻反思,马斯克也对此表示关注。
Anthropic研究员Jack Lindsey发表了一篇长达73页的论文,揭示了AI模型中类似「思想病毒」的传播机制,引发全球大模型安全讨论。论文证明某些提示可在不同模型间传播并改变其行为,引发业界对AI安全和模型对齐的深刻反思,马斯克也对此表示关注。