
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
KNN算法(k近邻算法)
存在一个样本数据集合,也称作训练样本集,并且样本集中的每个数据都存在标签,即知道样本集中每一数据与所属分类的对应关系。一般而言,我们只选择样本数据集中前k个最相似的数据,这就是KNN算法中K的由来,通常k是不大于20的整数。数据集是癌症检测数据,一共包括100行记录,第二列为癌症的结果,良性为’B‘,恶性’M‘,后面8列为肿瘤的各种数据,半径、纹理、周长、面积等。常用的距离量度方式包括:闵可夫斯基

到底了







