您的位置:首页 > 理论基础 > 计算机网络

Python 实现网络爬虫小程序

2014-04-30 18:36 495 查看
Python很简洁,也很强大,作为兴趣,值得一学!

下面这个程序实现的是从一个网站上下载图片,根据自己需要可以进行修改

import re
import urllib

def gethtml(url):
page = urllib.urlopen(url)
html = page.read()
return html

def getimg(html):
reg = r'src="(.*?\.jpg)"'
imgre = re.compile(reg)
imglist = re.findall(imgre, html)
x = 1
for imgurl in imglist:
urllib.urlretrieve(imgurl, '%s.jpg' % x)
x+=1

target = raw_input("Input one url:")
html =  gethtml(target)
print "please wating, pictrues are downloading....."
getimg(html)
内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息
标签: