爬虫|Python爬虫（批量爬取变形金刚图片，下载保存到本地。） python|python

本文的文字及图片来源于网络,仅供学习、交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理
本文文章来自：CSDN 作者：Guapifang

文章图片

其实和爬取普通数据本质一样，不过我们直接爬取数据会直接返回，爬取图片需要处理成二进制数据保存成图片格式（.jpg,.png等）的数据文本。
现在贴一个url=https://img.ivsky.com/img/tupian/t/201008/05/bianxingjingang-001.jpg
请复制上面的url直接在某个浏览器打开，你会看到如下内容：

文章图片

这就是通过网页访问到的该网站的该图片，于是我们可以直接利用requests模块，进行这个图片的请求，于是这个网站便会返回给我们该图片的数据，我们再把数据写入本地文件就行，比较简单。

import requests headers={ 'user-agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3861.400 QQBrowser/10.7.4313.400'} url='https://img.ivsky.com/img/tupian/t/201008/05/bianxingjingang-001.jpg' re=requests.get(url,headers=headers) print(re.status_code)#查看请求状态，返回200说明正常 path='test.jpg'#文件储存地址 with open(path, 'wb') as f:#把图片数据写入本地，wb表示二进制储存 for chunk in re.iter_content(chunk_size=128): f.write(chunk)

然后得到test.jpg图片，如下

文章图片

点击打开查看如下：

文章图片

便是下载成功辣，很简单吧。
现在分析下批量下载，我们将上面的代码打包成一个函数，于是针对每张图片，单独一个名字，单独一个图片文件请求，于是有如下代码：

import requests def get_pictures(url,path): headers={ 'user-agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3861.400 QQBrowser/10.7.4313.400'} re=requests.get(url,headers=headers) print(re.status_code)#查看请求状态，返回200说明正常 with open(path, 'wb') as f:#把图片数据写入本地，wb表示二进制储存 for chunk in re.iter_content(chunk_size=128): f.write(chunk) url='https://img.ivsky.com/img/tupian/t/201008/05/bianxingjingang-001.jpg' path='test.jpg'#文件储存地址 get_pictures(url,path)

现在要实现批量下载图片，也就是批量获得图片的url，那么我们就得分析网页的代码结构，打开原始网站https://www.ivsky.com/tupian/bianxingjingang_v622/，会看到如下的图片：

文章图片

于是我们需要分别得到该页面中显示的所有图片的url，于是我们再次用requests模块返回当前该页面的内容，如下：

import requests headers={ 'user-agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3861.400 QQBrowser/10.7.4313.400'} url='https://www.ivsky.com/tupian/bianxingjingang_v622/' re=requests.get(url,headers=headers) print(re.text)

运行会返回当前该页面的网页结构内容，于是我们找到和图片相关的也就是.jpg或者.png等图片格式的字条，如下：

文章图片

上面圈出来的**//img.ivsky.com/img/tupian/t/201008/05/bianxingjingang-017.jpg**便是我们的图片url，不过还需要前面加上https:，于是完成的url就是https://img.ivsky.com/img/tupian/t/201008/05/bianxingjingang-017.jpg。
我们知道了这个结构，现在就是把这个提取出来，写个简单的解析式：

import requests headers={ 'user-agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3861.400 QQBrowser/10.7.4313.400'} url='https://www.ivsky.com/tupian/bianxingjingang_v622/' re=requests.get(url,headers=headers) def get_pictures_urls(text): st='img src="' m=len(st) i=0 n=len(text) urls=[]#储存url while i



 打印结果如下：
  

文章图片 


 得到了url，现在就直接放入一开始的get_pictures函数中，爬取图片辣。

 
import requests
def get_pictures(url,path):
headers={
'user-agent': 'Mozilla/5.0 (Windows NT 10.0;
 WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/70.0.3538.25 Safari/537.36 Core/1.70.3861.400 QQBrowser/10.7.4313.400'}
re=requests.get(url,headers=headers)
print(re.status_code)#查看请求状态，返回200说明正常
with open(path, 'wb') as f:#把图片数据写入本地，wb表示二进制储存
for chunk in re.iter_content(chunk_size=128):
f.write(chunk)
def get_pictures_urls(text):
st='img src="'
m=len(st)
i=0
n=len(text)
urls=[]#储存url
while i


 【爬虫|Python爬虫（批量爬取变形金刚图片，下载保存到本地。）】结果如下：
  

文章图片 


 然后就完成辣，这里只是简单介绍下批量爬取图片的过程，具体的网站需要具体分析，所以本文尽可能详细的展示了批量爬取图片的过程分析，希望对你的学习有所帮助，如有问题请及时指出，谢谢~


		  	

    
    




    
    
    


推荐阅读

           
                  
              
                  婕珞芙晨露蔷薇面膜怎么样 婕路芙晨露蔷薇面膜可以分两次用吗 
                
                   
                
              
            

                  
              
                  猪肉各部位的区别 猪肉哪个部位是一等肉 
                
                   
                
              
            

                  
              
                  最早指南车发明人 指南车发明者 
                
                   
                
              
            

                  
              
                  银天下行情分析系统软件下载 
                
                   
                
              
            

                  
              
                  redis跳跃表查找数据的过程 redis哪块用到跳表 
                
                   
                
              
            

                  
              
                  华为荣耀play3有没有指纹解锁（华为荣耀play3有指纹解锁吗） 
                
                   
                
              
            

                  
              
                  amdk15支持什么cpu，amdk15主板支持的cpu 
                
                   
                
              
            

                  
              
                  女性揉地筋的好处 主要有这些好处 
                
                   
                
              
            

                  
              
                  汽车原厂互联映射什么意思 
                
                   
                
              
            

                  
              
                  常年不在家冰箱怎么办？如何维护和保养？ 
                
                   
                
              
            

                  
              
                  怎样识别变频空调和定频空调 空调开一天多少钱 
                
                   
                
              
            

                  
              
                  七绝（云水一梦惹东风） 
                
                   
                
              
            

                  
              
                  新办企业个税申报密码 申报个税在哪个软件，企业个税能用手机申报吗 
                
                   
                
              
            

                  
              
                  运动会通讯稿300字 
                
                   
                
              
            

                  
              
                  美的SC861A吸尘器不充电的解决方法 
                
                   
                
              
            

                  
              
                  刘海屏|iPhone 14强势曝光：是不是后悔手里的iPhone 13买早了？ 
                
                   
                
              
            

                  
              
                  iphone|从12999元跌至10488元，12G+512G，华为顶级旗舰现货供应不用抢购 
                
                   
                
              
            

                  
              
                  绝地求生刺激战场国际服 绝地求生刺激战场国际服下载方法有哪些 
                
                   
                
              
            

                  
              
                  无症状感染者会一直不发病吗 
                
                   
                
              
            

                  
              
                  泰顺云雾茶是什么茶 泰顺雾云农庄 
                
                   
                
              
            

          

界面化小程序|女友问（你上班怎么摸鱼没被发现（我反手就给她开发了个桌面宠物—爽）） 
 工具|Python 爬虫批量爬取网页图片保存到本地 
 视频爬虫及破解|python反混淆javascript代码 
 python自动化测试|自动化测试——Selenium+Python之下拉菜单的定位 
 自动化测试|selenium自动化测试——元素定位篇（下） 
 python|Python文件操作及 json 
 测试用例|自动化测试——unittest框架 
 单元测试|自动化测试——selenium（环境部署和元素定位篇） 
 python|ViT结构