
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
爬虫---获取指定标签内的文本
学习爬虫主要是为了从网站上获取我们想要的数据,但是工作以后,我们爬去的数据是多种多样的,所以这就要求我们掌握多种查找数据的方式。今天以查找文本为例给大家介绍我常用的四种查找数据的方式。以在scrapy框架抓取百度贴吧为例,介绍四种抓取文本的方式。1. 获取最外层标签,遍历内部所有的子标签“/text()”,获取标签文本class XiaoshuoSpider(scrapy.Spide...
python---日志模块
贴一个封装好的日志模块,可以直接放在项目中,日志存放的路径配置一下就可以#!/user/bin/even python# -*- coding:utf-8 -*-import osimport timeimport loggingimport inspectfrom logging.handlers import RotatingFileHandlerfrom sns_spider.config.
到底了







