使用 run_evaluate.py 评估自定义报告
作者: guijuzhejiang创建于 2026年1月23日更新于 2026年1月23日
我注意到,可以使用 Python 测试/ run_evaluate.py 脚本来评估"深度研究基准"数据集。但是,我想要评估我生成的自定义报告。是否也可以使用 run_evaluate.py 来实现此目的?如果可以,我应该如何修改 dataset_name 以适应我的自定义报告?
内容来源: langchain-ai/open_deep_research