logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Python排序:揭秘“天才般”的桶排序

桶排序(基数排序)凭借 “分而治之” 的思想,在整数排序场景中展现出极高的效率,是算法学习和工程实践中不可或缺的工具。不同于比较类排序算法,桶排序通过将数据分配到不同的 “桶” 中,再对桶内数据单独排序,最后合并结果,能在特定条件下实现线性时间复杂度。从基础的冒泡、选择排序,到进阶的快速、归并排序,每种算法都有其独特的适用场景。然后按当前位分桶,提取出当前位的数字,将该数放入对应桶中,再清空原先数

#算法#数据结构#排序算法
Python快速排序详解:从原理到双指针实现

此时数组被基准值3分为了两部分,左边都是小于3的数字,右边都是大于3的数字,对左子数组[2,1]和右子数组[4,5]重复上述过程,最终得到有序数组[1,2,3,4,5]:arr=[3,1,4,2,5],left(左指针)=0,right(右指针)=4,jizhun(基准值)=3,i=left=0,j=right=4。,继续比较:arr[2]=4>3-->右指针指向的数字替换成当前左指针指向的数字,

#python#算法#排序算法
Python:获取快看漫画内容

在浏览快看漫画时,我们常会遇到想要保存喜欢的漫画章节图片的需求。的完整爬虫流程,不仅解决了手动保存的低效问题,还深入学习了正则表达式、Unicode 编码处理和文件操作等核心技能。(注意:由于编者获取到的需要vip,故这里用获取其他图片来代为演示,读者重要的是理解思路。爬虫是一把双刃剑,在享受技术便利的同时,务必遵守法律法规和平台规则,合理使用技术。最后使用os创建目录,然后将获取到的漫画下载到本

#python#开发语言
Python字体映射讲解:解决网页字体反爬问题

('0x30', 'zero')变成('zero','0'),即把 cmap 里的 “编码 - 名称” 对,转换成一个字典 item,键是名称(如 "eight"),值是对应的字符(如 "8")这时运行后我们将看见这个字体文件中的内容,这是我们就可以分析其结构,从中提取出想要的内容,先读取文件,再使用正则表达式提取出cmap标签下的所有元素。需要注意的是,最后的结果是将上面cmap标签里获得的('

#python#开发语言#爬虫
Python 爬虫:自动获取小说内容

在 Python 中,使用爬虫获取网络信息是一项非常实用的技能。本教程将以自动获取小说《斗罗大陆》为例,带你完整走一遍爬虫流程,让你对 “发送请求 — 解析数据 — 保存内容” 有清晰的理解。需要注意的是,要提前安装好xpath插件,可以直接去edge扩展程序里搜索xpath selector。ps:本教程仅用于技术学习与交流,在进行任何网络爬取前,请遵循相关法律法。需要注意的是,User-Age

#python#爬虫#开发语言
Python:自动获取字体加密的番茄小说内容

番茄小说就是其中之一,它通过自定义字体将小说正文的字符映射到了 Unicode 私有用区,使得直接抓取到的 HTML 源码是一堆无法直接阅读的 “乱码”。(补充:ddddocr仅适用于版本号小于python3.13的版本,编者使用的是3.11.4版本,读者最好使用3.11或3.10的版本,避免版本不兼容。此时仅获取的是第一章的内容,又经过网页分析,发现番茄小说里面下一章按钮是button元素,没有

#python#开发语言#爬虫 +1
Python爬虫:自动获取起点小说内容

章节列表获取、章节内容爬取与本地保存的完整流程,同时结合实战细节讲解爬虫核心知识点,帮助大家巩固 Requests 请求、正则表达式、XPath 解析等关键技能。为了简便,可以取href的长度来看一共有多少章,len(href),用for循环输出前三章。发现文章内容都在p标签下的span元素里,但若以这个为内容的xpath会发现输出为空。这是因为网页里的源代码是经过浏览器渲染的,故获取的xpath

#python#爬虫#开发语言
到底了