跳到正文
原文
Johann Rehberger / Embrace The Red(RSS)·· 2026-08-17精选AI 评分78

实测复现加密 LLM 推理痕迹恢复攻击:跨账户还原 OpenAI GPT-5.6 推理内容

Recovering Encrypted LLM Reasoning Traces

AI 导读

作者 Johann Rehberger 复现论文《Stealing Reasoning Traces from Proprietary LLM APIs》的方法,将 GPT-5.6 Sol 产生的加密推理 blob 重放给同厂商的 GPT-5.6 Luna 并配合轻微越狱提示词,成功在跨模型、跨会话甚至跨账户情况下恢复推理内容,包括原推理中出现的密码。

推荐理由

作者独立复现了论文中恢复加密推理痕迹的攻击,并给出跨账户恢复密码的实测细节和会话文件风险提示。

来源:Johann Rehberger / Embrace The Red(RSS) · embracethered.com