本研究提出了一种方法,通过不超过20个二元问题,在黑箱环境中有效区分两个大型语言模型(LLMs)。作者开发了两种提问启发式方法,能够在使用一半问题的情况下有效区分22个LLMs,为审核者提供隐秘性优势。
完成下面两步后,将自动完成登录并继续当前操作。