UnicodeDecodeError: 'unicodeescape' 编码器无法解码位置 108130 中的字节 0x5c: \ 在字符串末尾
#302 问题标题已更改,因此我创建了一个新问题。 我使用了 hardikvasa:master + Joeclinton1:patch-1 的 google-images-download 库。 我遇到了一个问题。 >> 很遗憾,无法下载所有 20 个图像,因为其中一些图像无法下载。 我修改了第 753 行。 - start_line = s.find("AF_initDataCallback({key: '\\'ds:2\\'") - 10 + start_line = s.find("AF_initDataCallback({key: '\\'ds:1\\'") - 10 直到 2 个星期前,我一直都能很好地使用它。 但是,最近,我又遇到了一个问题。 >> UnicodeDecodeError: 'unicodeescape' 编码器无法解码位置 108130 中的字节 0x5c: \ 在字符串末尾。 我打印了 object_raw。 我找到了最后一个位置中的缺失值。 >> ... \u003dfin",null,null,"Finance",false,null,null,null,null,null,[22]\n,null,null,22]\n]\n]\n,0,null,null,null,[]\n] \n 我将索引值更改为恢复最后一个字符。 我修改了第 756 行。 - object_raw = str(s[start_object:end_object]) + object_raw = str(s[start_object:end_object+1]) >> ... \u003dfin",null,null,"Finance",false,null,null,null,null,null,[22]\n,null,null,22]\n]\n]\n,0,null,null,null,[]\n]\n 我以这种方式解决了这个问题。 如果我的方法有问题,请给我一些建议。 此外,我使用了此 URL 中的代码示例进行测试。 - https://google-images-download.readthedocs.io/en/latest/examples.html# - from google_images_download import google_images_download # 导入库 - response = google_images_download.googleimagesdownload() # 类实例化 - arguments = {"keywords":"Polar bears,baloons,Beaches","limit":20,"print_urls":True} # 创建参数列表 - paths = response.download(arguments) # 将参数传递给函数 - print(paths) # 打印下载图像的绝对路径
内容来源: hardikvasa/google-images-download