当前位置:  编程技术>python

python抓取网页图片并放到指定文件夹

    来源: 互联网  发布时间:2014-10-04

    本文导语:  python抓取网站图片并放到指定文件夹 代码如下:# -*- coding=utf-8 -*-import urllib2import urllibimport socketimport osimport redef Docment():    print u'把文件存在E:Python图(请输入数字或字母)'    h=raw_input()    path=u'E:Python图'+str(h)    if not os...

python抓取网站图片并放到指定文件夹

代码如下:

# -*- coding=utf-8 -*-
import urllib2
import urllib
import socket
import os
import re
def Docment():
    print u'把文件存在E:Python图(请输入数字或字母)'
    h=raw_input()
    path=u'E:Python图'+str(h)
    if not os.path.exists(path):
        os.makedirs(path)
    return path
def getallurl(/tech-python/html/index.html):
    reg=r"a href='/tech-python/(/.htm)._'"
    allurl= re.compile(reg)
    allList = re.findall(allurl,html)
    return allList
def getHTML(url):
    url=url
    req_header = {'User-Agent':'Mozilla/5.0 (Windows; U; Windows NT 6.1; en-US; rv:1.9.1.6) Gecko/20091201 Firefox/3.5.6'}
    req_timeout = 20
    html='cuowu'
    try:
        req = urllib2.Request(url,None,req_header)
        resp = urllib2.urlopen(req,None,req_timeout)
        html = resp.read()
    except urllib2.URLError as e:
        print e.message
    except socket.timeout as e:
        getHTML(url,fu)
    return html
def getImg(html,path):
    reg = r'img class=IMG_show border=0 src=(.*?.jpg)'
    imgre= re.compile(reg)
    imgList = re.findall(imgre, html)
    if imgList:
        print 'ghasghg',path
        for imgurl in imgList:
            print imgurl
            content2=urllib2.urlopen(imgurl).read()
            with open(path+'/'+imgurl[-7:],'wb') as code:
                code.write(content2)
    else:
        return 0
def getallurl(/tech-python/html/index.html):
    reg=r"a href='/tech-python/(/.htm)._'"
    allurl= re.compile(reg)
    allList = re.findall(allurl,html)
    return allList
j=1
i=0
print u'请输入网址:'
ul=raw_input()
print u'开始下载'
print u'第'+str(j)+u'页'
html=getHTML(ul)
allList=getallurl(/tech-python/html/index.html)
path=Docment()
getImg(html,path)
while i

    
 
 

您可能感兴趣的文章:

  • 基于python实现的网络爬虫功能:自动抓取网页介绍
  • python采用requests库模拟登录和抓取数据的简单示例
  • python抓取网页内容示例分享
  • python抓取网页中的图片示例
  • Python抓取Discuz!用户名脚本代码
  • python抓取豆瓣图片并自动保存示例学习
  • python 自动提交和抓取网页
  • python抓取京东价格分析京东商品价格走势
  • 使用python BeautifulSoup库抓取58手机维修信息
  • python小技巧之批量抓取美女图片
  • python使用beautifulsoup从爱奇艺网抓取视频播放
  • python抓取京东商城手机列表url实例代码
  • python抓取网页图片示例(python爬虫)
  • python抓取网页时字符集转换问题处理方案分享
  • python正则匹配抓取豆瓣电影链接和评论代码分享
  • python正则表达式抓取成语网站
  • python抓取某汽车网数据解析html存入excel示例
  • 深度剖析使用python抓取网页正文的源码
  • javascript开源软件 iis7站长之家
  • Python使用代理抓取网站图片(多线程)
  • Python代理抓取并验证使用多线程实现
  • python遍历文件夹并删除特定格式文件的示例
  • python目录操作之python遍历文件夹后将结果存储为xml
  • Python引用(import)文件夹下的py文件的方法
  • python使用循环实现批量创建文件夹示例
  • python使用os模块的os.walk遍历文件夹示例
  • python 查找文件夹下所有文件 实现代码
  • windows系统中python使用rar命令压缩多个文件夹示例
  • Python写的创建文件夹自定义函数mkdir()
  • python2.7删除文件夹和删除文件代码实例
  • 通过python下载FTP上的文件夹的实现代码
  •  
    本站(WWW.)旨在分享和传播互联网科技相关的资讯和技术,将尽最大努力为读者提供更好的信息聚合和浏览方式。
    本站(WWW.)站内文章除注明原创外,均为转载、整理或搜集自网络。欢迎任何形式的转载,转载请注明出处。












  • 相关文章推荐
  • Python GUI编程:tkinter实现一个窗口并居中代码
  • 让python同时兼容python2和python3的8个技巧分享
  • Python不使用print而直接输出二进制字符串
  • 使用setup.py安装python包和卸载python包的方法
  • Python中实现json字符串和dict类型的互转
  • 不小心把linux自带的python卸载了,导致安装一个依赖原python的软件不能安装,请问该怎么办?
  • python异常信息堆栈输出到日志文件
  • Python开发者社区整站源码 Pythoner
  • python下用os.execl执行centos下的系统时间同步命令ntpdate
  • python读取csv文件示例(python操作csv)
  • Python namedtuple对象json序列化/反序列化及对象恢复
  • python基础教程之python消息摘要算法使用示例
  • Python获取网页编码的方法及示例代码
  • 新手该如何学python怎么学好python?
  • Python异常模块traceback用法举例
  • 使用python删除nginx缓存文件示例(python文件操作)
  • python之平台独立的调试工具winpdb介绍
  • python学习手册中的python多态示例代码
  • 基于Python的Html/xml解析库Beautiful Soup 4.2.1发布
  • 请教:system("C:\python2.4\python.exe C:\aa.py");该语句有何错误?为什么运行界面一闪就消失了并且没有运行完,请给出正确语句!
  • 测试Python内部类型及type和isinstance用法区别
  • python版本的问题




  • 特别声明:169IT网站部分信息来自互联网,如果侵犯您的权利,请及时告知,本站将立即删除!

    ©2012-2021,,E-mail:www_#163.com(请将#改为@)

    浙ICP备11055608号-3