logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

通过mapReduce实现基于项目的协同过滤推荐

通过mapReduce实现基于项目的协同过滤推荐需求介绍协同过滤推荐网上有很多种介绍,我这里主要介绍的是基于项目的协同过滤。基于项目的协同过滤推荐基于这样的假设:一个用户会喜欢他之前喜欢的项目相似的项目。因此,基于项目的协同过滤推荐关键在于计算物品之间的相似度。数据介绍我选用的数据集合如下:1,101,5.01,102,3.01,103,2.52,101,2.02,1

#mapreduce
基于Jupyter平台通过python实现Spark的应用程序之wordCount

1、启动spark平台,界面如下:2、启动Jupyter,界面如下图所示:如果你对以上启动存在疑问的话,请看我的上一篇博客,关于Jupyter配置Spark的。3、功能分析- 我们要实现的一个功能是统计词频- 我们需要把统计的文件上传到hdfs里面- 编写python脚本4、代码实现- 上传文件到hdfs我有一个hello.txt文件,里面有两行

#python#spark
到底了