错误: DSCoSTEERRunner 将绑定最小化分数视为改进
作者: yifanxiong272创建于 2026年8月29日更新于 2026年8月29日
标签bug
□ 总结
`DSCoSTEERRunner.should use new evo'在最大化和最小化目标之间处理捆绑得分不一致。
当self.scen.medical diction'为True'(较高者更好)时,不选择捆绑分数:
新积分 ===
# should use new evo(.) 返回 False当self.scen.medical diction'为false'(较低者更好)时,则选择相同的捆绑分数:
[Python] 新积分 ===
should use new evo(...) 返回 True
这似乎来自于一个布尔比较,将"不大于"和"严格低于"混为一谈,以达到最小化. 目前的表达式有效地使最小化使用"不大于"而不是"小于".
□ 重现
1. 请检查date=中的日期值 (帮助)
2. 从源头上安装RD-Agent.
3. 创建 " 测试/情景/数据 科学/测试 运行者 tie score policy.py " :
```2ZZ
从类型导入简单Namespace
从rdagent.组件.coder.CoSTEER.评估器导入CoSTEER多向后
从rdagent.scenarios.data science.dev.runner导入DSCoSTEERRunner
从 rdagent.scenarios.data science.dev.runner.ev.eval 导入 DSRunnerFeedback 中获取的文本
def make feedback(分数) :
返回 CoSTEER 多功能后退( []
DSRunner 退后 ()
执行="ok",
返回 检查=“ok”,
代码="OK",
最后决定=真理,
可接受=真实,
分数=分数,
(中文(简体) ).
) )
def make runner( 度量 方向) :
leader = object. new (DS CoSTEERRunner) 数据格式化为新类型 :
trax.scen = 简单Name 空间( miteral direction = meteral direction)
返回运行器
def 测试 tied score are not 已处理 as 改进 for minimization ():
碱基 = make feedback(1.0)
绑定 = make feedback( 1. 0)
维护 make runner( 度量 方向= True) 。 should use new evo ()
基础,
绑了
是虚假的
维护 make runner( 度量 方向=虚假) 。 should use new evo ()
基础,
绑了
是虚假的- 运行:
{\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你觉得呢? Python - m pytest test/scasearios/data science/test runner tie score policy.py-q (中文(简体) ).
5. 注意最小化的说法失败。
□ 预期行为
捆绑分数不应被视为严格的改进.
为了与当前最大化行为保持一致:
```4ZZ
base. score ==============================================================================================================================================================================应返回 " 假 " ,用于更高和较低等的衡量标准。
如果打算接受这种联系,政策就应该明确,在两个方向上对称。
□ 实际行为
绑定最大化大小写返回假',但绑定最小大小写返回真':
页:1 Assertion 错误: 断言 True is False
因此,一个比分更低的跑步可以取代目前的候选人,尽管新候选人没有提高分数.
□ 截图
不适用;这是确定单位一级的复制。
□ 环境
- 当前操作系统名称:macOS
- 处理器结构:arm64
- Python版本:`3.11.15'
- 说吧
. . . . . . .内容来源: microsoft/RD-Agent