百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页

deepeval · Issues· 614 开放

在 GitHub 打开

本地同步的开放议题(评论请到 GitHub 查看)

  • #3150

    [TS] 0.9.13 版发布的 dist/telemetry.js 文件包含已删除的 @sentry/node,每个 CLI 命令都会崩溃

    更新于 2026年9月18日
  • #3303

    LangChain CallbackHandler 实现了 on_llm_error/on_tool_error/on_retriever_error,但没有实现 on_chain_error,因此出错的链条范围永远不会退出,其追踪信息也永远不会发布

    更新于 2026年9月16日
  • #3299

    EvaluationDataset.save_as('csv'/'jsonl') 在重新加载时会将包含 '|' 的上下文项分割开来

    更新于 2026年9月16日
  • #262

    将 JudgeLM 添加为评估和比较历史测试运行的方式

    enhancementhelp wanted更新于 2026年9月15日
  • #3287

    KimiModel.__init__ 在选择的模型没有注册定价时,会引发 TypeError float(None)

    更新于 2026年9月15日
  • #3283

    详细的法官判决在 role_violation、prompt_alignment 和 conversation_completeness 中被评分为通过

    更新于 2026年9月14日
  • #3133

    OpenAIModel 拒绝未知目录 ID; LocalModel base_url 是 Chat Completions 路径

    更新于 2026年9月14日
  • #3208

    HumanEval 基准测试使用 bare assert 来验证 n/k,并接受无效值

    更新于 2026年9月14日
  • #2748

    使用合成客户支持案例添加零售支持评估示例

    更新于 2026年9月14日
  • #3220

    fix(metrics): 仅包含空格的 actual_output/expected_output 通过了空参保护

    更新于 2026年9月13日
  • #3126

    问题: 稳定的缓存格式,用于读取每个测试用例的指标分数

    更新于 2026年9月12日
  • #3263

    OpenInference TOOL 在非字典工具参数上记录 drop 工具,并将 tools_called 输出设置为空 (Strands 奇偶性)

    更新于 2026年9月10日
  • #3261

    AgentCore TOOL 覆盖了 drop gen_ai.tool.call.result,并在非字典工具参数上崩溃(Strands 奇偶性)

    更新于 2026年9月10日
  • #3186

    fix(scorer): scorers 将仅包含空格的预测视为非空

    更新于 2026年9月8日
  • #3257

    [首次贡献者] 正在寻找适合初学者的问题来贡献

    更新于 2026年9月8日