[BUG] K8s 执行器: 在 Job 重试中成功的块仍然导致管道运行失败(backoff_limit > 0)
作者: Poil创建于 2026年9月1日更新于 2026年9月1日
- 使用 k8s 执行器,在执行器配置中设置
backoff_limit大于 0(services/k8s/config.py读取executor_config.job.backoff_limit;默认为 0)。 2. 让一个块在第一次尝试中发生失败,出现可重试的临时错误(在我们的情况下,是 Redshift 的XX000错误,该错误与并发的真空/删除操作冲突,数据库自身的消息是“请重试”)。 3. 让 Kubernetes 任务重试该 pod。
内容来源: mage-ai/mage-ai