
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
Kmeans均值聚类算法Kmeans白话理解Kmeans原理详解聚类与分类原理介绍工作流程评价指标Kmeans代码实现聊一聊Kmeans的缺点及优化Kmeans白话理解Kmeans,又作K-means,顾名思义,K均值聚类算法。Kmeans算法将数据集分为K个簇,使每个簇簇内距离小,簇间距离大。Kmeans原理详解聚类与分类聚类,是将一堆没有标签的数据分成几簇,我们并不关心这一类是什么,我们关心的
关于Win11和Ubuntu20.04时间同步Win11与Ubuntu20.04时间不同步原因解决方法Win11与Ubuntu20.04时间不同步原因Win11与Ubuntu采用的时间设置不一样,Windows11采用的是LocalTime机制,把BIOS中的时间(存储在电脑主板里的时间)作为本地时间,所以WIndows11与BIOS中的时间是保持一致的Ubuntu采用的是一种UTC机制,默认BI
李沐的《动手学深度学习》学习笔记
配置过程1. 下载Anaconda博主选择的是香饽饽——清华镜像,网址放下面,喜欢的小伙伴自取:清华大学开源软件镜像站页面如下图所示,选择anaconda进入选择archive/进入选择最新的anaconda版本进行安装,博主选择的是Anaconda3-2021.05-Windows-x86_64.exe点击下载2. 安装Anaconda点击自己下载的exe文件,出现如图所示的界面点击I Agre
大家新年好!这是第二期的爬虫与数据分析啦,很高兴新年里与大家再次见面!本次要实现的爬虫功能是:爬取bilibili的弹幕,并把爬取的弹幕写入到excel中首先,上B站找一个自己喜欢的视频,且弹幕量比较多的(博主最近迷上了星辰大海,so……理所当然了,哈哈哈哈哈,真的很好听!)视频的地址:https://www.bilibili.com/video/BV1my4y1n7fw?from=search&
利用爬虫获取某地1月份的天气情况(最高温度和最低温度),并作出相关的曲线图实现思路:1.首先,利用requests模块对url发送请求# 定义url和请求头url = 'http://tianqihoubao.com/lishi/xian/month/202101.html'headers = {'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64;
好久不更爬虫与数据分析系列的文章了最近学妹拜托我帮她完成了一份爬虫大作业借着这个机会,更一期的爬虫与数据分析主题是非常常见的爬取豆瓣读书与豆瓣电影博主发现一个非常有意思的现象,去年学习爬虫的时候,练手豆瓣读书与豆瓣电影时,爬取还挺容易的,反爬措施也没有那么强~今天我在爬取的时候,大概只请求了几次,好家伙直接给我IP封了,像这样:IP代理的话,我还在学习,不太会整,然后用了一个非常巧妙的fake-U
西湖大学自然语言处理(八)—— 朴素贝叶斯文本分类Text classification under MLEThe Bayes ruleNaive Bayes model parameterisation processTraining a Navie Bayes classifierNavie Bayes text classificationGenerative modelsEvaluatin
西湖大学自然语言处理(七)—— 解决OOV问题的两种平滑技术Knesser-Ney Smoothingabsolute discount smoothingGood-Turing Smoothing平滑的目的——解决数据稀疏性的问题Knesser-Ney Smoothing核心思想——劫富济贫absolute discount smoothing公式:P(w∣u)=max(uw∈D−δ,0)∑w′
西湖大学自然语言处理(三)——自然语言处理任务介绍Fundamental NLP tasksSynatactic tasks(句法分析任务)Word LevelSentence levelSemantic tasks(语义分析任务)Word levelSentence levelText entailment(自然语言推理)Discourse tasks(篇章分析)Information Extr







