文章指出,AI Agent 因具备浏览网页、调用工具和长期记忆等能力,攻击面扩展至推理过程。文中展示了一个恶意网页示例,通过伪装成身份验证步骤,诱导AI逐步拼出用户姓名(如“Elwood”),导致敏感信息泄露。这凸显了AI交互中隐藏指令带来的安全风险。
近期,AI审稿人在期刊中被广泛使用,部分作者在论文中插入隐藏指令以操控AI给出好评。日本经济新闻报道,17篇论文中发现此类秘密指令,涉及多个国家的高校。这一事件引发了对AI审稿伦理的讨论,专家呼吁重新审视AI在学术中的应用界限。
完成下面两步后,将自动完成登录并继续当前操作。