7-1



import numpy as np
import pandas as pd

# python 库的安装方式:
# 1、在IDE环境下安装,以pycharm为例,找到python软件包,搜索要安装的软件包安装即可。验证安装成功:在代码中输入import 安装库名字 运行代码不报错即安装成功。
# 2、win+R,输入cmd,打开命令行窗口,输入 pip install 安装库名字 ,回车安装。验证安装成功:输入python进行python编译环境,输入import 安装库名字 回车不报错即可。

# 换行:视图 活动编辑器  自动换行

# pandas 数据分析
# numpy 针对数组有丰富的数据函数

# pandas支持两种数据结构:series(一维数组) dataframe(二维数组)数据类型:object

sname = pd.Series([1,2,3,4],name='学号',index=[1,2,3,4]) # 定义变量sname ,数据类型是object,是一维数组,将列表转换成一维数组
# name 为Series指定列名,index 指定索引
print(sname)
print(sname.name) #取该一维数组的名称
print(sname.index) #取该一维数组的索引
print(sname.values) #输出结果[1 2 3 4]
print(sname[1]) #取索引是1的元素

student = pd.DataFrame([[1,"张三"],[2,"李四"],[3,"王五"]],columns = ['学号','姓名'],index=[1,2,3]) #将列表嵌套列表转换成二维数组
print(student)
print(student.columns) # 取每列的名字
print(student.values) # 取二维数组的值
print(student['学号']) # 取 学号  那列的值
print(student['学号'][1]) #取 学号 列的索引是 1 的值
# 大家出现的错误:1、两个库装了一个,另一个没装 2、import pandas as pd   没有重命名,import拼错
# 3、DataFrame 写成DateFrame 4、列表的元素未用逗号分割

wuchang = pd.Series(['中国','俄罗斯','法国','英国','美国'],name = '国家',index = ['001','002','003','004','005'])
print(wuchang)
print(wuchang['001'])

wuchang = pd.DataFrame([['中国',1],['俄罗斯',2],['法国',3],['英国',4],['美国',5]],columns = ['国家','排位'],index = ['001','002','003','004','005'])
print(wuchang)

stu_info = pd.DataFrame([['甲',16,'女'],['乙',17,'女'],['丙',16,'男'],['丁',17,'男'],['戊',18,'男']],columns = ['姓名','年龄','性别'],index=[1,2,3,4,5])

print(stu_info)










8-1


import numpy as np
import pandas as pd


# 两种数据结构:一维数组 Series 二维数组 DataFrame

# pip install pandas 终端下面的安装命令

stu_list = ['张','王','李']
stu_series = pd.Series(stu_list,index=[1,2,3],name='姓名')
print(stu_series)

stu_dict = {1:'张',2:'王',3:'李'}
stu_series = pd.Series(stu_dict.values(),index = stu_dict.keys(),name='姓名')
print(stu_series)

stu_list = [[1,'张'],[2,'王'],[3,'李']] #用列表嵌套列表表示二维表
stu_dataframe = pd.DataFrame(stu_list,index = [1,2,3],columns = ['学号','姓名'])
print(stu_dataframe)

stu_dict = {1:['张','男'],2:['王','男'],3:['李','男']}
stu_dataframe = pd.DataFrame(stu_dict.values(),index = stu_dict.keys(),columns = ['姓名','性别'])
print(stu_dataframe)

stu_dataframe=pd.read_csv('data.csv',sep=',',header=0,names=['学号','姓名','性别'])
print(stu_dataframe)

stu_dataframe=pd.read_csv('data2.csv',sep=';',header=1)
print(stu_dataframe)

# pandas的read_csv(),将csv文件转换成dataframe二位数据格式,sep是用什么分隔,header默认是0,首行不是列名,如果header=1,首行是列名,用names更改列名。





9-1

import numpy as np
import pandas as pd

# shengsiche shengsiche gaoyuhang shengsiche gaoyuhang zhengzimo yangyichen
# liubingcheng yangruixuan 刘龙 xuchengzhen maruipng songyiyang zhanghao zixuan shifeifan zhengxiaokun-1
# maruiping maruiping caixiaojun-1 yuanyutong-1
stu_series = pd.Series([1,2,3,4],index=['001','002','003','004'],name='值')
print(stu_series)

stu_df = pd.DataFrame([[1,'A'],[2,'B'],[3,'C']],index=[1,2,3],columns=['数值','字母'])
print(stu_df)

stu_dict={1:'A',2:'B'}
# 字典,冒号前面是key,冒号后面是value
print(stu_dict.keys()) #[1,2]
print(stu_dict.values()) #['A','B']

stu_s= pd.Series(stu_dict.values(),index=stu_dict.keys(),name='字母')
print(stu_s)

stu_dict2={1:['A','男'],2:['B','女']}
print(stu_dict2.keys()) #[1, 2]
print(stu_dict2.values()) #[['A', '男'], ['B', '女']]

# maruiping shengsiche liuyuning
stu_df2=pd.DataFrame(stu_dict2.values(),index=stu_dict2.keys(),columns=['字母','性别'])
print(stu_df2)

csv_df=pd.read_csv('C:\\Users\\209\\Desktop\\data2.csv',sep=',',header=0)
print(csv_df)

csv_df=pd.read_csv(r'C:\Users\209\Desktop\data2.csv',sep=',',header=0)
print(csv_df)

# 找转义字符帮忙或者取消转义
csv_df=pd.read_csv(r'..\data2.csv',sep=',',header=0)
print(csv_df)

# 相对路径:python文件和数据文件在同一个文件夹下,直接写数据文件名称加后缀;当数据文件在python文件的下层文件夹时,先找到下层文件夹,再找到数据文件;当数据文件在python文件的上层文件夹时,先往上找到两个文件同在的文件夹,再往下找到数据文件。

# 常识:一般情况下,在python文件的位置建立data文件夹,里面放置数据文件,如果移动python文件,要同时移动data文件夹

stu_df2.to_csv('stu_df2.csv') #stu_df2.csv导出到同文件夹下
stu_df2.to_csv(r'data\stu_df2.csv') #stu_df2.csv导出到子文件夹data下
stu_df2.to_csv(r'..\stu_df2.csv') #stu_df2.csv导出到上层文件夹下

# yuanyutong-1-1 gaokexin-1 shengsiche

print(stu_df2.info()) #查看dataframe对象的基本信息
print(stu_df2.head(1)) #取前多少行数据,括号中不写默认是10
print(stu_df2.tail(1)) #取最后多少行数据,括号中不写默认是10

print(stu_df2.describe())

更多推荐