您的位置：首页 > 其它

小爬虫——下载给定网页上的图片

2013-07-02 13:25 190 查看

# -*- coding: utf-8 -*-

import re

import urllib

def getHtml(url):

#找出给出网页的源码

page = urllib.urlopen(url)

html = page.read()

return html

def getImg(html):

#正则

reg = r'src="(.*?\.jpg)"'

#编译正则

imgre = re.compile(reg)

#找出图片地址

imglist = re.findall(imgre,html)

#循环遍历

x = 0

for i in imglist:

urllib.urlretrieve(i,'%s.jpg' % x)

x+=1

html = getHtml(r'http://www.renren.com/')

getImg(html)

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签：

相关文章推荐

小爬虫——下载给定网页上的图片
从给定网页上下载<img src="" />格式的图片，并保存到制指定路径
简单爬虫源码，下载指定网页所有图片
小爬虫-一个网页上的.jpg图片下载下来
Python 爬虫5——爬取并下载网页指定规格的图片
Python 爬虫学习网页图片下载
下载给定网页上图片的方法
python爬虫一：必应图片（从网页源代码中找出图片链接然后下载）
python 网页爬虫，下载网络图片
python3 网页爬虫图片下载无效链接处理 try except
【Python】python3实现网页爬虫下载图片
python爬虫（1）下载任意网页图片
Python 爬虫5——爬取并下载网页指定规格的图片
一个小爬虫从网页获取信息（图片下载）
python脚本工具－1 制作爬虫下载网页图片
Python3.x爬虫下载网页图片的实例讲解
网络爬虫之Scrapy实战四：爬取网页下载图片
[python][爬虫]从网页中下载图片
简单的网络爬虫设计——下载网页图片

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航