#1455·RD-Agent

错误: DSCoSTEERRunner 将绑定最小化分数视为改进

作者: yifanxiong272创建于 2026年8月29日更新于 2026年8月29日
标签bug

□ 总结

`DSCoSTEERRunner.should use new evo'在最大化和最小化目标之间处理捆绑得分不一致。

self.scen.medical diction'为True'(较高者更好)时,不选择捆绑分数:

zz
新积分 ===
# should use  new evo(.) 返回 False

self.scen.medical diction'为false'(较低者更好)时,则选择相同的捆绑分数:

[Python] 新积分 ===

should use new evo(...) 返回 True


这似乎来自于一个布尔比较,将"不大于"和"严格低于"混为一谈,以达到最小化. 目前的表达式有效地使最小化使用"不大于"而不是"小于".

□ 重现

1. 请检查date=中的日期值 (帮助)

2. 从源头上安装RD-Agent.

3. 创建 " 测试/情景/数据 科学/测试 运行者 tie score policy.py " :

```2ZZ
从类型导入简单Namespace

从rdagent.组件.coder.CoSTEER.评估器导入CoSTEER多向后
从rdagent.scenarios.data science.dev.runner导入DSCoSTEERRunner
从 rdagent.scenarios.data science.dev.runner.ev.eval 导入 DSRunnerFeedback 中获取的文本


def make feedback(分数) :
返回 CoSTEER 多功能后退( []
DSRunner 退后 ()
执行="ok",
返回 检查=“ok”,
代码="OK",
最后决定=真理,
可接受=真实,
分数=分数,
(中文(简体) ).
) )


def make runner( 度量 方向) :
leader = object.  new (DS CoSTEERRunner) 数据格式化为新类型 :
trax.scen = 简单Name 空间( miteral  direction = meteral  direction)
返回运行器


def 测试 tied score are not 已处理 as 改进  for minimization ():
碱基 = make feedback(1.0)
绑定 = make  feedback( 1. 0)

维护 make  runner( 度量  方向= True) 。 should  use  new  evo ()
基础,
绑了
是虚假的
维护 make runner( 度量  方向=虚假) 。 should  use  new  evo ()
基础,
绑了
是虚假的
  1. 运行:

{\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你觉得呢? Python - m pytest test/scasearios/data science/test runner tie score policy.py-q (中文(简体) ).


5. 注意最小化的说法失败。

□ 预期行为

捆绑分数不应被视为严格的改进.

为了与当前最大化行为保持一致:

```4ZZ
base. score ==============================================================================================================================================================================

应返回 " 假 " ,用于更高和较低等的衡量标准。

如果打算接受这种联系,政策就应该明确,在两个方向上对称。

□ 实际行为

绑定最大化大小写返回假',但绑定最小大小写返回真':

页:1 Assertion 错误: 断言 True is False


因此,一个比分更低的跑步可以取代目前的候选人,尽管新候选人没有提高分数.

□ 截图

不适用;这是确定单位一级的复制。

□ 环境

- 当前操作系统名称:macOS
- 处理器结构:arm64
- Python版本:`3.11.15'
- 说吧
. . . . . . .

内容来源: microsoft/RD-Agent