
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
导出导入数据【重要】导入加载数据pd.read_xxx('文件路径')# 常用方法 read_csv(),read_excel()# 加载mysql数据库数据# 方法一:用DBAPI构建数据库链接engineimport pandas as pdimport pymysqlconn = pymysql.connect(host='localhost',user='root',passwor
整理数据学习目标掌握melt函数整理数据的方法掌握stack、unstack的用法掌握wide_to_long函数的用法1 melt整理数据1.1 宽数据集变为长数据集加载美国收入与宗教信仰数据import pandas as pdpew = pd.read_csv('data/pew.csv')pew# 输出结果如下图[外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传(img-
缺失数据处理学习目标知道什么是缺失值,为什么会产生缺失值熟练掌握缺失值处理的方式1 NaN简介好多数据集都含缺失数据。缺失数据有多重表现形式数据库中,缺失数据表示为NULL在某些编程语言中用NA或None表示缺失值也可能是空字符串''或数值 0在Pandas中使用NaN表示缺失值Pandas中的NaN值来自NumPy库,NumPy中缺失值有几种表示形式:NaN,NAN,nan,他们都一样缺失值和其
9、字典的定义格式:变量 = {key1 : value1, key2: value2…}空字典定义:{}dict()字典中键不能重复,是唯一的,但是值可以重复字典中的键要见名知意,体现字典可以见名知意的特性# 字典:储存多个数据,以键值对形式存储,方便快速存取# 字典的键要见名知意# 字典定义格式: 变量 = {键1:值1, 键2:值2.....}dict1 = {'name': 'xiaomi
Linux_day02今日课程学习目标1、掌握Linux用户、权限管理2、掌握Linux常用系统命令3、掌握服务器集群环境搭建4、了解shell编程今日课程内容大纲# Linux用户与权限管理用户、用户组及其管理文件权限rwxsu、sudo# 系统信息时间、日期进程磁盘使用情况、内存使用情况#linux集群环境搭建重中之重集群、分布式---->多台机器虚拟机克隆服务器基础环境准备1、防火墙关
2.1 线性回归简介学习目标了解线性回归的应用场景知道线性回归的定义1 线性回归应用场景房价预测销售额预测贷款额度预测线性关系举例:2 什么是线性回归2.1 定义与公式线性回归(Linear regression)是利用回归方程(函数)对一个或多个自变量(特征值)和因变量(目标值)之间关系进行建模的一种分析方式。特点:只有一个自变量的情况称为单变量回归,多于一个自变量情况的叫做多元回归。通用公式
窗口函数:seleect 聚合函数 over(partition by_______ order by ________)from table;基本语法:<window_function>over(…)优点:简单窗口函数更易于使用。在上面的示例中,与使用聚合函数然后合并结果相比,使用窗口函数仅需要多一行就可以获得所需要的结果。快速这一点与上一点相关,使用窗口函数比使用替代方法要快得多。
pymysql五步骤:①导入pymysql模块②创建连接③获取游标④执行SQL语句⑤关闭连接(关闭游标,关闭连接)pymysql添加数据表数据:#导入模块import pymysql#建立连接conn=pymysql.connect(host='127.0.0.1',port=3306,user='root',password='root',database='db_itheima',charse
4.1 决策树算法简介学习目标知道什么是决策树能够通过sklearn实现决策树分类,进一步认识决策树1 概念决策树思想的来源非常朴素,程序设计中的条件分支结构就是if-else结构,最早的决策树就是利用这类结构分割数据的一种分类学习方法。决策树:怎么理解这句话?通过一个对话例子:“闺女,我又给你找了个合适的对象,今天要不要见一面?”“多大? ” “26岁。”“长得帅吗? ” “还可以,不算太帅。”







