python爬虫项目-一见倾心壁纸

时间：2019-12-07 22:24:07 阅读：113 评论：0 收藏：0 [点我收藏+]

来自：https://www.cnblogs.com/xdd1997/p/11962969.html
import re
import urllib
import urllib.request

def getHtml(url):
    page = urllib.request.urlopen(url)
    html = page.read()
    return html

def getImage(html,x):
    #https://mmbiz.qpic.cn/mmbiz_jpg/ib55rg6wzUc3B16KIY3uU53nkcTTDic8uEA4WWBPaHJ8LpibvAnkpS2FZtyjrv7w7dbEeNrhfvPuuyReNAxsLdgJA/640?wx_fmt=jpeg
    #https://mmbiz.qpic.cn/mmbiz_jpg/ib55rg6wzUc3B16KIY3uU53nkcTTDic8uEHqocI7r86nehl2NeForAqvcTiaEAIuWjTWPKNXnnXIPuUuqnuJeFKYw/640?wx_fmt=jpeg
    #此处正则为重点
    reg = ‘data-src="(.*?)"‘
    image = re.compile(reg)
    imlist = re.findall(reg,html.decode(‘utf-8‘))

    print(imlist)
    for i in imlist:
        print(i)
        print(x)
        urllib.request.urlretrieve(i,‘%s.jpg‘ % x)
        x +=1
    return x
x=1
url = ‘https://mp.weixin.qq.com/s/MVDcn0O3093OlIhMYkqBIA‘
html = getHtml(url)
x = getImage(html,x)
print(‘下载完成‘)
#下载结果与此.py文件在同一目录

python爬虫项目-一见倾心壁纸

原文：https://www.cnblogs.com/gisoracle/p/12003609.html

踩

(0)

评论一句话评论（0）

分享档案

更多>

2021年09月23日 (328)
2021年09月24日 (313)
2021年09月17日 (191)
2021年09月15日 (369)
2021年09月16日 (411)
2021年09月13日 (439)
2021年09月11日 (398)
2021年09月12日 (393)
2021年09月10日 (160)
2021年09月08日 (222)