fix(Outreach): 在爬虫失败或超时后,过时的 scraper_results.csv 可以重新使用

作者: LocNguyenSGU创建于 2026年4月15日更新于 2026年4月15日

□ 总结

外联可以重复使用先前运行时的`.mp/scraper results.csv'数据,当当前刮取器执行失败或不产生新输出文件而发生时。

由于代码只检查结果文件是否存在,一个旧文件可以当作属于当前运行.

□ 当前的行为

`Outreach.start ()' 将刮去输出写入固定路径:

  • `.mp/scraper results.csv'

在操作刮刀后,它只检查:

zz
如果不是 os. path. 存在(输出  path):
. . . . . . . .

如果该文件已经从之前的成功运行中存在,则代码会继续读取并延续电子邮件流,即使当前的刮发器运行失败或没有生成新的输出.

□ 预期行为

外联流程只应处理当前运行产生的拆散结果。

可能的修正 :

  • 在开始刮取器前删除任何先前的结果文件
  • 验证输出文件在当前运行期间新创建或修改
  • 将每个运行记录到一个独特的临时文件,并且只在成功时促进它

□ 证据

相关代码路径 :

  • " 弧/缓冲 "
  • get results cache path ()' 总是返回固定路径 :.mp/scraper results.csv'
  • `弧/级/射程.py'
  • 运行有“ {输出 path} ” 的刮刮器
  • 在读取结果之前,只检查`os.path.highs (output path)'
  • 运行前不清除旧输出
  • 不验证文件的修改时间或新鲜度

□再现.

  1. 一旦存在 " .mp/scraper results.csv " ,就成功开展外联工作。
  2. 再次开展外联工作。
  3. 在撰写新的结果文件之前,使当前刮刮器运行失败或超时。
  4. 观察到应用程序仍然找到 ".mp/scraper results.csv " ,并着手使用旧数据处理/发送电子邮件。

∮为什么这很重要∮

这会导致将外联邮件发送到先前运行的 stale 线索,这特别危险,因为用户可能相信当前刮擦成功.

□ 复制检查

  • 检查了空出问题:没有找到用于旧结果重复使用的匹配问题
  • 检查已结问题:没有找到匹配问题
  • 检查最近的公关:没有找到匹配的公关

内容来源: FujiwaraChoki/MoneyPrinterV2