论文提出Stellar Colosseum推理脚手架,将长程科研拆解为路线探索、成熟度判断、分段证明与反证修复,并强调显式依赖关系,使验证失败能精准回退。作者主张多智能体应从角色扮演转向可检查的推理项目管理,核心在于路线多样性、独立验证与错误回流,而非Agent数量。
完成下面两步后,将自动完成登录并继续当前操作。