logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

基于hadoop豆瓣电影数据分析

代码:load data local inpath "/home/liuxuanting/douban_movie-1686527723744.txt" into table lxt_2021900406;代码:hdfs dfs -copyFromLocal /home/liuxuanting/liuxuanting1 /log/代码:put ‘lxt_2021900406’,’1’,’info:

文章图片
#hadoop#大数据
在hive中实现wordcount算法

在Java和hive中均能进行wordcount算法,但在hive中更为简便,接下来就是在hive中实现wordcount算法的简便步骤:

文章图片
#hadoop#hdfs#hive +1
在Ubuntu安装Anaconda、Pycharm和如何在linux里创建Pycharm的快捷键

之后依旧一直按回车,显示出Do you wish the installar to initialize之后输入yes,就会自动配置环境变量。指令:sudo gedit /usr/share/applications/pycharm.desktop。指令:tar zxf pycharm-community-2023.2.2.tar.gz。在pycharm-community-2023.2.2的bi

文章图片
#ubuntu#python#linux
在Ubuntu安装Anaconda、Pycharm和如何在linux里创建Pycharm的快捷键

之后依旧一直按回车,显示出Do you wish the installar to initialize之后输入yes,就会自动配置环境变量。指令:sudo gedit /usr/share/applications/pycharm.desktop。指令:tar zxf pycharm-community-2023.2.2.tar.gz。在pycharm-community-2023.2.2的bi

文章图片
#ubuntu#python#linux
基于爬虫和Kettle的豆瓣电影的采集与预处理

将豆瓣电影网上的电影的基本信息,比如:电影名称、导演、电影类型、国家、上映年份、评分、评论人数爬取出来,并将爬取的结果放入csv文件中,方便存储。6、在get_info函数中,同样构造请求URL,设置请求头,并发送GET请求以获取电影详情页的内容。7、使用lxml库解析电影详情页的内容,提取导演、电影类型、国家、上映时间、评分和评论人数等信息。每一个电影包括电影名称、导演、电影类型、国家、上映年份

文章图片
#python
数据库课程设计超市信息管理系统

进行数据库项目设计,项目为超市信息管理系统

文章图片
#mysql#数据库
nosql数据库期末考试知识点总结

包括文档数据库、键值数据库、图形数据库、列族数据库。1、键值数据库:这种类型的数据库主要使用散列表来存储数据,其简单和易部署,能更快速的数据定位。2、文档数据库:这种类型的数据库的存储格式类似于JSON的文档格式。文档数据库的优点是可以方便地处理半结构化数据。3、列族数据库:这种类型的数据库主要用于分布式存储的海量数据。4、图形数据库:这种类型的数据库主要用于存储图结构数据。其中键值数据库更加简单

文章图片
#nosql#数据库
nosql数据库期末考试知识点总结

包括文档数据库、键值数据库、图形数据库、列族数据库。1、键值数据库:这种类型的数据库主要使用散列表来存储数据,其简单和易部署,能更快速的数据定位。2、文档数据库:这种类型的数据库的存储格式类似于JSON的文档格式。文档数据库的优点是可以方便地处理半结构化数据。3、列族数据库:这种类型的数据库主要用于分布式存储的海量数据。4、图形数据库:这种类型的数据库主要用于存储图结构数据。其中键值数据库更加简单

文章图片
#nosql#数据库
数据库课程设计超市信息管理系统

进行数据库项目设计,项目为超市信息管理系统

文章图片
#mysql#数据库
    共 13 条
  • 1
  • 2
  • 请选择