新加坡国立大学提出COTA框架,利用0.5B小模型比较候选动作而非直接解题,在运行时干预大模型智能体,在9个组合上均获最佳性能,平均开销1.38倍。关键在成对比较与建设性干预,直接接管会导致崩溃。成本有边界,部分环境开销较高。
完成下面两步后,将自动完成登录并继续当前操作。