有时候我们的爬虫不一定只是爬取文本数据,也会爬取一些图片,下面就来看怎么将爬取的图片存到本地磁盘。
我们先来选好目标,知乎话题:女生怎么健身锻造好身材?(单纯因为图多,不要多想哦(# _ # ) )
看下页面的源代码,找到话题下图片链接的格式,如图:
可以看到,图片在img标签中,且class=origin_image zh-lightbox-thumb,而且链接是由.jpg结尾,我们便可以用Beautiful Soup结合正则表达式的方式来提取所有链接,如下:
links = soup.find_all('img', "origin_image
zh-lightbox-thumb",src=http://www.77cn.com.cnpile(r'.jpg$'))
提取出所有链接后,使用request.urlretrieve来将所有链接保存到本地
百度搜索“77cn”或“免费范文网”即可找到本站免费阅读全部范文。收藏本站方便下次阅读,免费范文网,提供经典小说教育文库北大青鸟:你需要的python爬虫笔记(11)在线全文阅读。
相关推荐: