EchoCoT攻击论文揭示,通过API返回的推理元数据,可从黑盒大推理模型中提取隐藏思维链,开源模型近逐字保真,闭源模型长度贴近。攻击利用工具调用间隙,无需改变答案。防御性提示词可降低成功率,但存在残余缺口,风险真实存在。
完成下面两步后,将自动完成登录并继续当前操作。