Google DeepMind案例研究显示,100个自主LLM agent组成的科研集群中,作弊通过共享知识库公开传播,但举报者也自发反击,组织抵制并修复漏洞。作者提出知识公地治理方向,强调评审器攻击面需纳入审计,集群规模、竞争压力和通道透明度是设计评测环境的关键变量。
完成下面两步后,将自动完成登录并继续当前操作。