博客
关于我
Python之爬虫-校花网
阅读量:445 次
发布时间:2019-03-06

本文共 727 字,大约阅读时间需要 2 分钟。

Python之爬虫-校花网

#!/usr/bin/env python# -*- coding:utf-8 -*-import reimport requests# 拿到校花网主页的内容response = requests.get('http://www.xiaohuar.com/')data = response.text# 拿到校花网所有的图片链接results = re.findall('lazysrc="(.*?)"', data)for result in results:  # type:str    # 判断是不是有链接的    if result.startswith('htt'):        pass    else:        img_result = 'http://www.xiaohuar.com/' + result        # 获取图片内容        img_response = requests.get(img_result)        img_data = img_response.content        img_name = result.split('/')[3]        img_filename = img_name + '.jpg'        print(img_filename)        # 保存图片内容        with open(img_filename, 'wb') as f:  # write,read,wb是写入二进制            f.write(img_data)            print('爬取成功一张')

转载地址:http://hzgyz.baihongyu.com/

你可能感兴趣的文章
Netty 编解码器详解
查看>>
Netty 解决TCP粘包/半包使用
查看>>
Netty 调用,效率这么低还用啥?
查看>>
Netty+Protostuff实现单机压测秒级接收35万个对象实践经验分享
查看>>
Netty+SpringBoot+FastDFS+Html5实现聊天App详解(一)
查看>>
netty--helloword程序
查看>>
Netty5.x 和3.x、4.x的区别及注意事项(官方翻译)
查看>>
netty——bytebuf的创建、内存分配与池化、组成、扩容规则、写入读取、内存回收、零拷贝
查看>>
netty——Channl的常用方法、ChannelFuture、CloseFuture
查看>>
netty——Future和Promise的使用 线程间的通信
查看>>
netty——Handler和pipeline
查看>>
Vue输出HTML
查看>>
netty——黏包半包的解决方案、滑动窗口的概念
查看>>
Netty中Http客户端、服务端的编解码器
查看>>
Netty中使用WebSocket实现服务端与客户端的长连接通信发送消息
查看>>
Netty中实现多客户端连接与通信-以实现聊天室群聊功能为例(附代码下载)
查看>>
Netty中的组件是怎么交互的?
查看>>
Netty中集成Protobuf实现Java对象数据传递
查看>>
netty之 定长数据流处理数据粘包问题
查看>>
Netty事件注册机制深入解析
查看>>