
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
首先我们找到python的官方网站,点击download下载,就可以看到各个版本的python解释器,我们选择相对稳定的版本而非最新版本,因为最新的版本还处于准备阶段,可能会与市面上的一些功能不兼容,我们可以选择与自己电脑适配的版本,比如3.10、3.11等。在这里我选择3.9.9版本作为演示,点击页面进入后,向下滑动找到Files,选择对应自己系统的Operating system,安装Desc
Python 中组合数据类型是编程核心基础,包含列表(list)、元组(tuple)、字典(dict)与集合(set)。每一种数据类型都有特定的用处和特征,合理掌握各类数据结构的特点与用法,能高效存储、处理数据,为后续编程学习打下坚实基础。本文是面向新手将使用列表类型的使用方式来介绍。

首先我们找到python的官方网站,点击download下载,就可以看到各个版本的python解释器,我们选择相对稳定的版本而非最新版本,因为最新的版本还处于准备阶段,可能会与市面上的一些功能不兼容,我们可以选择与自己电脑适配的版本,比如3.10、3.11等。在这里我选择3.9.9版本作为演示,点击页面进入后,向下滑动找到Files,选择对应自己系统的Operating system,安装Desc
print(f"警告:图片 {img_path} 缺失,跳过")return读取灰度图(flags=0),统一缩放为 120×180 像素。如果文件不存在,打印警告并跳过(避免崩溃)。
本篇文章从零起步,不讲晦涩公式推导,用大白话讲懂混淆矩阵所有知识点,零基础也能一次性吃透,学完直接用于项目实战、论文实验、模型调优。混淆矩阵是分类任务中最核心的模型评估表格,专门用来直观统计模型预测结果对错分布,主要应用在二分类、多分类场景,日常使用最多的是二分类混淆矩阵。简单理解:把真实标签和模型预测标签两两对应摆放,统计每一种组合的样本数量,形成的二维表格就是混淆矩阵。它的最大作用就是不再只看

对于刚接触机器学习聚类算法的小伙伴来说,K-Means(K 均值聚类) 是最经典的无监督学习算法之一。但很多新手都会遇到一个核心问题:怎么确定聚类的最优 K 值(簇的数量)?本文用啤酒数据集作为实战案例,选择 K-Means 最优聚类数,代码全程可直接运行,有需要可自取。K-means 聚类广泛应用于市场细分、图像分割、文档聚类等领域。例如,在市场营销中,可以将客户划分为不同的群体,以便进行更针对

信用卡欺诈是典型的类别极不平衡的分类问题:正常交易(负样本)远多于欺诈交易(正样本)。如果直接用原始数据训练模型,模型会倾向于把所有样本都预测为“正常”,导致召回率极低。本文使用下采样(Undersampling)平衡正负样本,并用逻辑回归建模,最后通过调整分类阈值提升欺诈交易的召回率。本文通过一个完整的代码实例,展示了信用卡欺诈检测的完整流程:数据标准化与清洗—>下采样处理类别不平衡—>交叉验证

信用卡欺诈检测是典型的类别极不平衡问题:正常交易(负样本)远多于欺诈交易(正样本)。如果直接用原始数据训练,模型会偏向多数类,导致召回率(Recall)很低。本文采用 SMOTE 过采样 技术生成少数类(欺诈)的新样本,使正负样本数量平衡,再使用逻辑回归建模,并通过交叉验证选择最佳正则化参数,最终评估模型性能。如果对该项目有兴趣但是没有了解的读者,可以先观看博主关于逻辑回归下采样的文章。【机器学习

在机器学习中,分类问题是最常见的任务之一。比如根据病人的各项指标判断病情等级、根据用户行为预测会员等级等。本文使用一个已经预处理好的多分类数据集(标签为 0、1、2、3),分别用 7 种经典的分类算法进行建模,并对比它们在测试集上的表现。本文以众数填充为例子。每个文件的第一列是标签(y),后面的列是特征(x)

作用:导入 PyTorch 核心库,所有深度学习操作的基础。类比:就像写作文要先拿笔,torch就是深度学习的 “笔”。作用:导入 PyTorch 的神经网络模块(Neural Network)。核心功能:提供搭建 CNN、全连接层、卷积层等所有网络层的工具。关键:我们搭建的所有 AI 模型,都依赖这个模块。作用:数据加载器,批量管理数据集。通俗理解:把大量图片打包成 “小包裹”,一次性喂给电脑,








