logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

KNN算法(k近邻算法)

存在一个样本数据集合,也称作训练样本集,并且样本集中的每个数据都存在标签,即知道样本集中每一数据与所属分类的对应关系。一般而言,我们只选择样本数据集中前k个最相似的数据,这就是KNN算法中K的由来,通常k是不大于20的整数。数据集是癌症检测数据,一共包括100行记录,第二列为癌症的结果,良性为’B‘,恶性’M‘,后面8列为肿瘤的各种数据,半径、纹理、周长、面积等。常用的距离量度方式包括:闵可夫斯基

文章图片
#算法#近邻算法#机器学习
到底了