长时智能体上下文管理采用两阶段预压缩:用量达90%时后台摘要前缀,达100%时仅合并摘要与尾部增量,减少主循环阻塞。压缩保留原始记录与本地JSONL恢复指针,并冻结系统提示以维持缓存命中。优先裁剪旧工具输出,避免不必要的LLM摘要。实测每轮输入token降低40%,上下文稳定在约28万。
完成下面两步后,将自动完成登录并继续当前操作。