logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

写爬虫时面对httpx和requests怎么选择呢

文章目录前言开始动手代码总结前言已经忘了多久没写博客,确实没什么时间也没什么精力。不过我觉得比起看理论的那些书,我还是更喜欢动手敲敲代码。政治不是说认识和实践要结合才能实现两次飞跃嘛,抽点空给自己放松一下。刷推文发现了httpx这个库,想试一下这个库怎么玩,所以随手写了个简单的代码来玩一下。开始动手先去看看httpx官方文档httpx官方文档链接从开头就看得出它支持同步和异步请求,并且只支持pyt

#python#httpx#爬虫
将白嫖进行到底?简单爬虫爬取B站视频

文章目录起因一步步实现方法一方法二代码结果最后起因作为一个B站的忠实粉丝,每天睡前和起床刷一下视频那是必须的。不过一般我都是在手机上刷,昨天用电脑刷的时候本来想下载一个视频,但是发现网页居然没有app的缓存功能,所以无奈只能自己动手写一个来下载视频了。(本来昨晚写完,辛辛苦苦还录了视频给B站投稿的,结果今天说内容违规无奈)一步步实现方法一这是我看的视频的页面,然后F12,去找视频网址...

数据分析第三天--数据清洗和数据转换

简单介绍我们通过一些方法获得数据之后,再通过上次讲的数据导入将得到的数据导入到编程环境中,接下来就到我们今天要聊的数据清洗和数据转换部分。步骤1.导入数据见上一篇博客2.数据清洗我们得到的数据可能会因为各种原因,导致部分数据存在错误,缺失,重复等问题,这样的数据一般称作“脏数据”,而我们直接得到的数据大多都是“脏数据”,所以我们就需要进行数据清洗这一步。数据排序数据排序是按照一定...

#数据分析
数据分析第四天--数据抽取、数据合并和数据计算

开头再对导入的数据进行清洗和相应的转换之后,我们就需要进一步的对我们所需要的数据进行抽取、合并和简单计算。今天我们就来聊一下这三步,然后数据处理部分就大致结束了,可以开始进行数据分析。1.数据抽取数据抽取,也叫做数据拆分,它是指保留,抽取原数据表中的某些数据形成一个新的数据表,主要方法有字段拆分、记录抽取和随机抽取。1.1字段拆分抽取某一字段的部分信息,形成一个新的字段1.1.1按位置...

#数据分析
数据分析---众包任务

文章目录前言开始动手1.导入数据,查看并且计算指标2.导入我们得到的指标,并且进行主成分分析3.添加主成分数据,进行拟合4.用svr给未完成的任务重新定价5.用原价格和主成分去训练SVM分类模型用刚刚训练好的SVM对新的价格和特征做预测模型评价最后前言依然是记录一次我的近期作业,这个做了一天半才做完,昨天通宵去拟合函数结果还是不理想,耽误了太多时间。主要原因还是昨天取的特征值太少了导致一直欠拟..

#数据分析#python#机器学习
数据分析-----基于水质图像的水质分析

文章目录1.前言2.正文作业背景及要求开始动手1.首先,进行图片处理得到颜色矩2.建模过程思考与改进结束1.前言这一次是分享一次我的作业,然后这个是我做的,等老师过几天分享他的之后我会把老师做得好的地方过来更新的。2.正文作业背景及要求还是之前的数据分析与挖掘实战里面的案例,得到的数据集是图片,然后我们需要进行提取图片的特征颜色矩然后建模,大概的流程和操作方法见下图。基本流程图像...

#python#机器学习
用python下载csdn中喜欢博主的文章

起因昨天中午正在舒舒服服的浏览着大佬们的博客,突然寝室又停电,WiFi也断了,还能不能愉快的玩耍了???虽然学校是有名的停电停网停水大学,但是每天中午停一次电也太难受了吧。难道是给新来的学弟们一个下马威,提前了解学校?于是想着能不能把博客下载保存到电脑上随时可以查看。开始动手首先查看csdn,就拿我的来分析首先要找到博主所有文章的url看到了所有的网址都有,那我们就需要想办法把ur...

用python下载csdn中喜欢博主的文章

起因昨天中午正在舒舒服服的浏览着大佬们的博客,突然寝室又停电,WiFi也断了,还能不能愉快的玩耍了???虽然学校是有名的停电停网停水大学,但是每天中午停一次电也太难受了吧。难道是给新来的学弟们一个下马威,提前了解学校?于是想着能不能把博客下载保存到电脑上随时可以查看。开始动手首先查看csdn,就拿我的来分析首先要找到博主所有文章的url看到了所有的网址都有,那我们就需要想办法把ur...

机器学习---8.聚类问题

之前讲的都是监督学习,今天来说说非监督学习。而其中聚类问题作为非监督学习的代表,更要好好谈谈。非监督学习回顾一下,什么是非监督学习。非监督学习是指不受监督的学习,是一种自由的学习方式,没有先验知识的指导。或者通俗一点地说就是不需要为训练集提供对应类别标签的学习方法非监督学习主要分为两种:聚类和降维所以下面聊聊几种聚类算法聚类问题聚类是指把相似的对象通过静态分类的方法分成不同组别的子集,...

数据分析大作业---山火/非法焚烧秸秆的预防系统

文章目录背景及要求开始动手1.数据探索2.数据预处理3.数据建模与模型评估1.SVM2.MLP3.随机森林4.开始试试CNN5.比较SVM和CNN6.Adaboost是否能挽回一点传统机器学习的颜面呢4.总结吐槽时间背景及要求然后数据呢是BMP格式的图片,大小为40*40,大致如下数据集目录结构其中0是非烟火,1是烟火然后总结一下任务本次大作业的目标是基于提供的图像,获得一个识别烟火的图像分类器。

#python#机器学习#数据分析
    共 19 条
  • 1
  • 2
  • 请选择