python爬虫保存图片

发布时间: 2024-04-13 03:13:58

① 如何用python做爬虫

在我们日常上网浏览网页的时候，经常会看到一些好看的图片，我们就希望把这些图片保存下载，或者用户用来做桌面壁纸，或者用来做设计的素材。

我们最常规的做法就是通过鼠标右键，选择另存为。但有些图片鼠标右键的时候并没有另存为选项，还有办法就通过就是通过截图工具截取下来，但这样就降低图片的清晰度。好吧其实你很厉害的，右键查看页面源代码。

我们可以通过python来实现这样一个简单的爬虫功能，把我们想要的代码爬取到本地。下面就看看如何使用python来实现这样一个功能。

② 使用Python爬虫下载图片，得到的图片不显示

你需要检查一下你的结果，看看是否请求成功了。可能服务器返回的并不是一个图片，但是你强制给他写入到图片格式文件中了，所以没办法显示。
你可以通过输出response或者使用抓包软件来检查。

③ python爬虫如何创建image文件夹

有自动创建功能，也可以使用代码。1.观察网页，找到img标签；2.通过requests和BS库来提取网页中的img标签；3.抓取

_mg标签后，再把里面的src给提取出来，接下来就可以下载图片了；

?

?4.通过urllib的urllib.urlretrieve来下载图片并且放进文件夹里面（第一之前的准备工作就是获取当前路径然后新建一个文件夹）；

?5.如果有多张图片，不断的重复3-4。

④ linux下python怎么写爬虫获取图片

跟linux有什么关系，python是跨平台的，爬取图片的代码如下：

import urllib.requestimport osimport randomdef url_open(url):
req=urllib.request.Request(url) #为请求设置user-agent,使得程序看起来更像一个人类
req.add_header('User-Agent','Mozilla/5.0 (Windows NT 6.1; WOW64; rv:43.0) Gecko/20100101 Firefox/43.0') #代理IP，使用户能以不同IP访问，从而防止被服务器发现
'''iplist=['1.193.162.123:8000','1.193.162.91:8000','1.193.163.32:8000']
proxy_support=urllib.request.ProxyHandler({'http':random.choice(iplist)})
opener=urllib.request.build_opener(proxy_support)
opener.addheaders=[('User-Agent','Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/42.0.2311.154 Safari/537.36 LBBROWSER')]

urllib.request.install_opener(opener)'''

response=urllib.request.urlopen(req)
html=response.read() return htmldef get_page(url):

html=url_open(url).decode('utf-8')
a=html.find('current-comment-page')+23
b=html.find(']',a) #print(html[a:b])
return html[a:b]def find_imgs(url):
html=url_open(url).decode('utf-8')
img_addrs=[]

a=html.find('img src=') while a!=-1:
b=html.find('.jpg',a,a+140) if b!=-1: if html[a+9]!='h':
img_addrs.append('http:'+html[a+9:b+4]) else:
img_addrs.append(html[a+9:b+4]) else:
b=a+9

a=html.find('img src=',b) for each in img_addrs:
print(each+'我的打印') return img_addrsdef save_imgs(folder,img_addrs):
for each in img_addrs: #print('one was saved')
filename=each.split('/')[-1] with open(filename,'wb') as f:
img=url_open(each)
f.write(img)def download_mm(folder='ooxx',pages=10):
os.mkdir(folder)
os.chdir(folder)

url=""
page_num=int(get_page(url)) for i in range(pages):
page_num=page_num-1
page_url=url+'page-'+str(page_num)+'#comments'
img_addrs=find_imgs(page_url)
save_imgs(folder,img_addrs)if __name__=='__main__':
download_mm()

完成

运行结果

⑤ python 如何将大量图片的url保存到本地

你如果要保存图片的url，直接把imgsrc写入本地文件就可以了，urllib.request.urlretrieve(imgsrc)这个的意思是你要保存的不是图片的url，而是要把图片下载下来，这个是要批量爬取网站上的图片，需要考虑网站的反爬虫措施了。

⑥ python爬虫将在线html网页中的图片链接替换成本地链接并将html文件下载到本地

正则匹配原链接替换为本地路径即可

阅读全文

热点内容

java返回this 发布：2025-10-20 08:28:16 浏览：1168

制作脚本网站发布：2025-10-20 08:17:34 浏览：1439

python中的init方法发布：2025-10-20 08:17:33 浏览：1132

图案密码什么意思发布：2025-10-20 08:16:56 浏览：1311

怎么清理微信视频缓存发布：2025-10-20 08:12:37 浏览：1165

c语言编译器怎么看执行过程发布：2025-10-20 08:00:32 浏览：1523

邮箱如何填写发信服务器发布：2025-10-20 07:45:27 浏览：724

shell脚本入门案例发布：2025-10-20 07:44:45 浏览：636

怎么上传照片浏览上传发布：2025-10-20 07:44:03 浏览：1294

python股票数据获取发布：2025-10-20 07:39:44 浏览：1368

python爬虫保存图片

与python爬虫保存图片相关的资讯