logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

数据分析之【渐近显著性(双侧)】与【精确显著性[2*(单侧显著性)]】的异同

渐近显著性和精确显著性适用于不同的情境,需要根据具体的研究问题和数据特点选择合适的方法。在大样本容量下,可以使用渐近显著性以取得更高效的计算;而在小样本的情况下,应该使用精确显著性来避免精确度的丢失。

文章图片
#数据分析#数据挖掘
数据分析之样本量-大样本与小样本的区分

小样本是指样本量较少的情况,具体多少才算小样本并没有一个确切的标准,一般来说,小样本的定义受到具体问题和研究领域的影响。简单来说,当样本量少到无法满足正态分布、中心极限定理等假设条件时,就可视为小样本。在某些研究领域中,如生物医学研究、心理学研究等,样本量一般较少,小于30或50的样本通常被认为是小样本。而在其他一些领域,如大数据分析、金融统计等,数百万甚至数亿的数据都是常态,少则数百、数千的样本

文章图片
#数据分析
数据分析之AB测试

AB测试就是通过将测试对象随机分成两组,然后控制其他变量一致的前提下,对其中一组进行某种行为或者功能的干预。继而计算AB效果的差异。学术说法:AB测试是基于统计学原理, 通过合理流量分配, 高效、准确选取局部指标价值最大化方案的一系列方法论的总和。

#数据分析#ab测试#数据挖掘
让数据分析说人话!PandasAI:当Pandas遇上大模型的颠覆性革新

PandasAI的革命性在于——用自然语言代替代码!只需一句"显示上海GDP超过4万亿的记录",即可完成相同操作

文章图片
#数据分析#pandas#数据挖掘
数据分析之异常值检验的方法

一、基于分布的方法1、3sigma基于正态分布,3sigma准则认为超过3sigma的数据为异常点def three_sigma(s):mu, std = np.mean(s), np.std(s)lower, upper = mu-3*std, mu+3*stdreturn lower, upper2、Z-scoreZ-score为标准分数,测量数据点和平均值的距离,若A与平均值相差2个标准差,

文章图片
#数据分析#python#机器学习
数据分析之样本量-大样本与小样本的区分

小样本是指样本量较少的情况,具体多少才算小样本并没有一个确切的标准,一般来说,小样本的定义受到具体问题和研究领域的影响。简单来说,当样本量少到无法满足正态分布、中心极限定理等假设条件时,就可视为小样本。在某些研究领域中,如生物医学研究、心理学研究等,样本量一般较少,小于30或50的样本通常被认为是小样本。而在其他一些领域,如大数据分析、金融统计等,数百万甚至数亿的数据都是常态,少则数百、数千的样本

文章图片
#数据分析
数据分析之【渐近显著性(双侧)】与【精确显著性[2*(单侧显著性)]】的异同

渐近显著性和精确显著性适用于不同的情境,需要根据具体的研究问题和数据特点选择合适的方法。在大样本容量下,可以使用渐近显著性以取得更高效的计算;而在小样本的情况下,应该使用精确显著性来避免精确度的丢失。

文章图片
#数据分析#数据挖掘
让数据分析说人话!PandasAI:当Pandas遇上大模型的颠覆性革新

PandasAI的革命性在于——用自然语言代替代码!只需一句"显示上海GDP超过4万亿的记录",即可完成相同操作

文章图片
#数据分析#pandas#数据挖掘
数据分析之AB测试

AB测试就是通过将测试对象随机分成两组,然后控制其他变量一致的前提下,对其中一组进行某种行为或者功能的干预。继而计算AB效果的差异。学术说法:AB测试是基于统计学原理, 通过合理流量分配, 高效、准确选取局部指标价值最大化方案的一系列方法论的总和。

#数据分析#ab测试#数据挖掘
数据分析之异常值检验的方法

一、基于分布的方法1、3sigma基于正态分布,3sigma准则认为超过3sigma的数据为异常点def three_sigma(s):mu, std = np.mean(s), np.std(s)lower, upper = mu-3*std, mu+3*stdreturn lower, upper2、Z-scoreZ-score为标准分数,测量数据点和平均值的距离,若A与平均值相差2个标准差,

文章图片
#数据分析#python#机器学习
    共 17 条
  • 1
  • 2
  • 请选择