
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
第2关:统计2020年国庆假期中电影票房增长最多的三部电影及其每日的票房数据。本关任务基于EduCoder平台提供的初始数据集,统计国庆假期中电影票房增长最多的三部电影及其每日的票房数据。编程要求本实验环境已开启Hadoop服务在 hive 中创建数据库mydb;注意:在开始要求2之前,建议您提前查看数据库中是否存在 moviecleaned 表(在环境没销毁的情况下,第一关的导入的数据可以持续使
任务描述本关任务:使用的对已经存在 Hbase 的共享单车运行数据进行分析,统计共享单车每天的平均使用时间,其中共享单车运行数据在的表中(表结构可在编程要求中进行查看)。相关知识为了完成本关任务,你需要掌握:如何配置的类是运行在上的一个并行计算框架,分为节点和节点。提供了的和两个方法来完成的配置。initTableMapperJob 方法:initTableReducerJob 方法:
电影票房之数据分析(Hive)第1关:统计2020年上映的电影中,当前总票房最高的10部电影。电影票房之数据分析(Hive)第1关:统计2020年上映的电影中,当前总票房最高的10部电影本关任务基于EduCoder平台提供的初始数据集,统计 2020 年上映的电影中,当前总票房最高的 10 部电影。编程要求本实验环境已开启Hadoop服务在 hive 中创建数据库 mydb;在 mydb 中创建
我们可以通过类加载器加载共享单车数据文件。文件中获取共享单车数据,保存到。将无效数据或非法数据进行抛出。说明:由于数据过多,我们将输出。开始你的任务吧,祝你成功!类封装了对应的批量存储到。共享单车数据结构和获取。根据提示,在右侧编辑器。目的地 = 所在城市。
第3关:统计2020年中当日综合总票房最多的10天本关任务基于EduCoder平台提供的初始数据集,统计 2020 年中当日综合总票房最多的 10 天及其当日综合总票房。编程要求本实验环境已开启Hadoop服务在 hive 中创建数据库mydb;注意:在开始要求2之前,建议您提前查看数据库中是否存在 moviecleaned 表(在环境没销毁的情况下,第一关的导入的数据可以持续使用)。如果不存在请
第1关:统计最热门的十种职业(招聘人数最多)第2关:分析学历相同的情况下每种职位的平均薪资第3关:统计各个职业要求具备的技能及其出现的次数第4关:分析每种职业在各个薪资等级需要招聘的人数任务描述在之前的任务中,我们完成了对招聘的清洗,接下来我们需要通过获取到的招聘数据来统计查询我们想要的数据信息。本关任务:统计最热门的十种职业(招聘人数最多)。在 hive 中创建数据库 mydb;在 mydb 中
电影票房之数据分析(Hive)第5关:统计2020年元旦节与国庆节放假后7天的观影人数本关任务基于EduCoder平台提供的初始数据集,统计 2020 年元旦节与国庆节放假后 7 天的观影人数。编程要求本实验环境已开启Hadoop服务在 hive 中创建数据库mydb;注意:在开始要求2之前,建议您提前查看数据库中是否存在 moviecleaned 表(在环境没销毁的情况下,第一关的导入的数据可以
任务描述本关任务:使用的对已经存在 Hbase 的共享单车运行数据进行分析,统计共享单车每天的平均使用时间,其中共享单车运行数据在的表中(表结构可在编程要求中进行查看)。相关知识为了完成本关任务,你需要掌握:如何配置的类是运行在上的一个并行计算框架,分为节点和节点。提供了的和两个方法来完成的配置。initTableMapperJob 方法:initTableReducerJob 方法:
电影票房之数据分析(Hive)第1关:统计2020年上映的电影中,当前总票房最高的10部电影。电影票房之数据分析(Hive)第1关:统计2020年上映的电影中,当前总票房最高的10部电影本关任务基于EduCoder平台提供的初始数据集,统计 2020 年上映的电影中,当前总票房最高的 10 部电影。编程要求本实验环境已开启Hadoop服务在 hive 中创建数据库 mydb;在 mydb 中创建
电影票房之数据清洗(MapReduce)第1关:数据清洗任务描述基于EduCoder平台提供的初始数据集(数据集存放在 /data/workspace/myshixun/data/movies.csv 中),按照下面的要求,完成电影票房数据的清洗工作。编程要求去掉字段“上映天数”中带有“零点场”、“点映”、“展映”和“重映”的电影数据;以字段“上映天数”和“当前日期”为依据,在尾列添加一个“上映日







