Anthropic发布73页重磅论文:揭示AI模型思想病毒传播机制

Anthropic发布73页重磅论文:揭示AI模型思想病毒传播机制

Anthropic研究员Jack Lindsey发表了一篇长达73页的论文,揭示了AI模型中类似「思想病毒」的传播机制,引发全球大模型安全讨论。论文证明某些提示可在不同模型间传播并改变其行为,引发业界对AI安全和模型对齐的深刻反思,马斯克也对此表示关注。

原始链接:https://36kr.com/p/3946348355157378

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注