Memos WorldMemos World
返回 AI Time

研究揭示专有 LLM 加密推理轨迹可被注入越狱

研究与安全次要
一份 arXiv 论文指出,Anthropic、OpenAI、Google 等专有 LLM 的加密推理轨迹块可跨会话、用户和模型互换,攻击者将其注入防护较弱的模型,可强制其以明文输出推理内容。

相关事件

相关主体