fix(Outreach): 在爬虫失败或超时后,过时的 scraper_results.csv 可以重新使用
作者: LocNguyenSGU创建于 2026年4月15日更新于 2026年4月15日
□ 总结
外联可以重复使用先前运行时的`.mp/scraper results.csv'数据,当当前刮取器执行失败或不产生新输出文件而发生时。
由于代码只检查结果文件是否存在,一个旧文件可以当作属于当前运行.
□ 当前的行为
`Outreach.start ()' 将刮去输出写入固定路径:
- `.mp/scraper results.csv'
在操作刮刀后,它只检查:
如果不是 os. path. 存在(输出 path):
. . . . . . . .如果该文件已经从之前的成功运行中存在,则代码会继续读取并延续电子邮件流,即使当前的刮发器运行失败或没有生成新的输出.
□ 预期行为
外联流程只应处理当前运行产生的拆散结果。
可能的修正 :
- 在开始刮取器前删除任何先前的结果文件
- 验证输出文件在当前运行期间新创建或修改
- 将每个运行记录到一个独特的临时文件,并且只在成功时促进它
□ 证据
相关代码路径 :
- " 弧/缓冲 "
get results cache path ()' 总是返回固定路径 :.mp/scraper results.csv'- `弧/级/射程.py'
- 运行有“ {输出 path} ” 的刮刮器
- 在读取结果之前,只检查`os.path.highs (output path)'
- 运行前不清除旧输出
- 不验证文件的修改时间或新鲜度
□再现.
- 一旦存在 " .mp/scraper results.csv " ,就成功开展外联工作。
- 再次开展外联工作。
- 在撰写新的结果文件之前,使当前刮刮器运行失败或超时。
- 观察到应用程序仍然找到 ".mp/scraper results.csv " ,并着手使用旧数据处理/发送电子邮件。
∮为什么这很重要∮
这会导致将外联邮件发送到先前运行的 stale 线索,这特别危险,因为用户可能相信当前刮擦成功.
□ 复制检查
- 检查了空出问题:没有找到用于旧结果重复使用的匹配问题
- 检查已结问题:没有找到匹配问题
- 检查最近的公关:没有找到匹配的公关
内容来源: FujiwaraChoki/MoneyPrinterV2