logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【python零基础教程第9讲】继承、多态、魔法函数

本文深入解析Python面向对象编程的核心概念和高级实践,重点介绍了继承、多态、魔法函数等关键特性。主要内容包括:1) 继承机制详解,包含单继承、super()调用、方法重写和多态实现;2) 多继承中的MRO方法和菱形继承问题;3) 全套魔法函数的应用,如字符串展示(str/repr)、容器操作(len/__getitem__等)、运算符重载(__add__等)和迭代协议(iter)。文章通过丰富

文章图片
#python#开发语言
【python零基础教程第12讲】Python 函数工具与类型注解

本文介绍了Python中提升代码质量的两大工具:functools函数工具和typing类型注解系统。主要内容包括: functools.partial:通过固定函数的部分参数创建新函数,简化重复调用场景,如回调函数预绑定和默认参数设置。 functools.lru_cache:实现函数级缓存优化,特别适合计算密集型纯函数,通过@lru_cache装饰器可显著提升递归等算法的性能。 typing模

文章图片
#python#java#网络
【爬虫入门第5讲】Python爬虫文本解析详解

本文全面介绍了Python中三种主流数据提取工具:BeautifulSoup4、lxml和正则表达式。BeautifulSoup4适合初学者,提供友好的API和CSS选择器;lxml性能优异,支持强大的XPath语法;正则表达式适合简单模式匹配。文章通过商品信息提取实例,对比了三者的特点:BeautifulSoup4容错性好但速度中等,lxml速度快但需学习XPath,正则表达式高效但功能有限。最

文章图片
#爬虫#python#开发语言
【爬虫入门第7讲】Python爬虫数据持久化全攻略

在数据驱动的时代,爬虫是获取网络信息的重要工具。然而,爬取到的数据若只停留在内存中,便如同沙上建塔——程序一停,一切归零。数据持久化是将爬取结果稳定存储的关键环节,它决定了数据能否被后续分析、可视化或长期使用。本文将从最简单的文本文件,到结构化的表格,再到功能强大的数据库,系统梳理Python爬虫中常用的数据持久化方案,并结合实际场景给出选型建议。

文章图片
#爬虫#python#开发语言
【爬虫入门第9讲】Python爬虫浏览器自动化

摘要: Selenium和Playwright是当前主流的浏览器自动化工具,适用于爬取动态网页和应对反爬机制。Selenium作为老牌工具,支持多种浏览器但速度较慢;Playwright由微软开发,内置浏览器、速度快且反检测能力强。两者在安装、核心功能和使用体验上各有优劣:Selenium生态成熟但配置复杂,Playwright安装简便、性能更优且原生支持异步。实际测试显示,Playwright在

文章图片
#爬虫#python#自动化
【爬虫入门第6讲】Python爬虫并发方案全解析

本文深入解析Python爬虫开发的三种并发方案:多线程、多进程和异步协程。多线程适合I/O密集型任务,实现简单但受GIL限制;多进程可绕过GIL,适合CPU密集型任务但内存开销大;异步协程通过事件循环实现高并发I/O操作,资源占用低。文章详细介绍了每种方案的适用场景、具体实现代码(包括线程池/进程池使用)以及各自的优缺点对比,帮助开发者根据任务类型选择最优的并发策略。特别针对爬虫场景,还提供了异步

文章图片
#爬虫#python#开发语言
【python零基础教程第7讲】常用标准库入门

本文介绍了Python中四个常用标准库和五个热门第三方库的使用方法。标准库部分涵盖:1)random模块的随机数生成和序列操作;2)time模块的时间戳处理与格式化;3)datetime模块的日期时间对象操作;4)json模块的数据序列化与文件读写。第三方库推荐包含requests(HTTP请求)、pandas(数据分析)、numpy(数值计算)、matplotlib(数据可视化)以及beauti

文章图片
#python#java#服务器
【爬虫入门第8讲】Python爬虫反爬入门

本文介绍了Python爬虫应对基础反爬机制的实战策略,包括伪装User-Agent、控制请求间隔、维持登录状态、设置Referer等基础防护手段。针对IP封禁问题,详细讲解了代理IP的使用方法,包括免费代理的局限性和付费代理的选择建议。文章还强调requests.Session()在维持会话状态和Cookie管理中的重要性,并提供了结合HTTPAdapter实现自动重试的进阶技巧。最后通过一个完整

文章图片
#爬虫#python#开发语言
【python零基础教程第3讲】输入、输出、变量与运算符全解析

本文系统介绍了Python编程基础核心概念: 输入输出:print()支持格式化输出(f-string推荐),input()获取用户输入并返回字符串 变量:动态类型特性,命名规范(下划线命名法),类型检查与转换(type()/int()/str()等) 运算符: 算术(+ - * / // % **) 赋值(= += -=等) 比较(== != > <) 逻辑(and or not) 成员(in

文章图片
#开发语言#python
【python零基础教程第11讲】Python 迭代器与生成器

本文深入探讨了Python中迭代器与生成器的核心概念与应用。首先从迭代器协议的基础入手,解释了__iter__()和__next__()方法的实现规则,并通过手动实现迭代器示例展示其工作原理。接着重点介绍了生成器函数和yield关键字,对比了生成器表达式与列表推导式的内存差异,强调生成器惰性求值的优势。最后详细讲解了生成器的高级操作,包括send()双向通信、close()关闭生成器以及throw

文章图片
#python#网络#开发语言
    共 22 条
  • 1
  • 2
  • 3
  • 请选择