本文评测了7个模型在Apache SeaTunnel AI CLI中的ETL任务表现,采用L1静态验证、L2 CLI校验和L3真实执行三层框架。结果显示,静态通过率不能预测真实执行成功率:GPT-5.6 Terra静态最高(93%)但执行仅74%,Claude Opus 4.8执行最佳(85%)。建议根据任务复杂度、修复预算和成本选择模型,并加强connector知识注入和规则覆盖。
完成下面两步后,将自动完成登录并继续当前操作。