Magnet框架由华盛顿大学研究者提出,用于检测跨会话AI滥用。攻击者将有害目标分解为多个无害子任务,在隔离会话中执行,规避单会话检测。Magnet通过能力累积建模、证据束组装和用户ID级聚合,识别跨会话组合后的危险行为。该方法面临计算复杂度、隐私和定义模糊等挑战,未来需在真实平台验证并探索与iCORE的整合。
完成下面两步后,将自动完成登录并继续当前操作。