deepeval · Issues· 614 开放
在 GitHub 打开本地同步的开放议题(评论请到 GitHub 查看)
- #3150
[TS] 0.9.13 版发布的 dist/telemetry.js 文件包含已删除的 @sentry/node,每个 CLI 命令都会崩溃
更新于 2026年9月18日 - #3303
LangChain CallbackHandler 实现了 on_llm_error/on_tool_error/on_retriever_error,但没有实现 on_chain_error,因此出错的链条范围永远不会退出,其追踪信息也永远不会发布
更新于 2026年9月16日 - #3299
EvaluationDataset.save_as('csv'/'jsonl') 在重新加载时会将包含 '|' 的上下文项分割开来
更新于 2026年9月16日 - #262
将 JudgeLM 添加为评估和比较历史测试运行的方式
enhancementhelp wanted更新于 2026年9月15日 - #3287
KimiModel.__init__ 在选择的模型没有注册定价时,会引发 TypeError float(None)
更新于 2026年9月15日 - #3283
详细的法官判决在 role_violation、prompt_alignment 和 conversation_completeness 中被评分为通过
更新于 2026年9月14日 - #3133
OpenAIModel 拒绝未知目录 ID; LocalModel base_url 是 Chat Completions 路径
更新于 2026年9月14日 - #3208
HumanEval 基准测试使用 bare assert 来验证 n/k,并接受无效值
更新于 2026年9月14日 - #2748
使用合成客户支持案例添加零售支持评估示例
更新于 2026年9月14日 - #3220
fix(metrics): 仅包含空格的 actual_output/expected_output 通过了空参保护
更新于 2026年9月13日 - #3126
问题: 稳定的缓存格式,用于读取每个测试用例的指标分数
更新于 2026年9月12日 - #3263
OpenInference TOOL 在非字典工具参数上记录 drop 工具,并将 tools_called 输出设置为空 (Strands 奇偶性)
更新于 2026年9月10日 - #3261
AgentCore TOOL 覆盖了 drop gen_ai.tool.call.result,并在非字典工具参数上崩溃(Strands 奇偶性)
更新于 2026年9月10日 - #3186
fix(scorer): scorers 将仅包含空格的预测视为非空
更新于 2026年9月8日 - #3257
[首次贡献者] 正在寻找适合初学者的问题来贡献
更新于 2026年9月8日