前Google DeepMind研究员Ilia Shumailov发现,只预填充2个推理token,Kimi K3的最终答案风格就变得和Opus一模一样。GLM、DeepSeek、Inkling都没这现象,纯Kimi特有。研究者从公开的Agent轨迹中解码出31.5万条隐藏推理,其中一些包含API密钥、邮箱、内部IP地址。研究还发现Anthropic、OpenAI、Google全都有同一个漏洞:大模型的加密推理可以被重放到同家族的小模型中。
前Google DeepMind研究员Ilia Shumailov发现,只预填充2个推理token,Kimi K3的最终答案风格就变得和Opus一模一样。GLM、DeepSeek、Inkling都没这现象,纯Kimi特有。研究者从公开的Agent轨迹中解码出31.5万条隐藏推理,其中一些包含API密钥、邮箱、内部IP地址。研究还发现Anthropic、OpenAI、Google全都有同一个漏洞:大模型的加密推理可以被重放到同家族的小模型中。