Hadoop HDFS操作指南
一、client1--hdfs操作
前提:已经安装好Hadoop并配置好环境;若为分布式集群,需确保各节点间 SSH 免密登录已配置;操作需使用具有 Hadoop 操作权限的用户。
1.启动集群
$HADOOP_HOME/sbin/start-dfs.sh

验证是否成功启动hdfs进程
jps

关闭HDFS集群,用jps验证
$HADOOP_HOME/sbin/stop-dfs.sh

2.单独控制进程
# 示例:启动 NameNode
$HADOOP_HOME/sbin/hadoop-daemon.sh start namenode
# 示例:查看 DataNode 状态
$HADOOP_HOME/sbin/hadoop-daemon.sh status datanode
# 示例:停止 SecondaryNameNode
$HADOOP_HOME/sbin/hadoop-daemon.sh stop secondarynamenode
# 新版 HDFS 命令(等效用法)
hdfs --daemon start namenode
hdfs --daemon status datanode
hdfs --daemon stop secondarynamenode





3.文件系统核心操作
创建HDFS目录
# 创建一级目录(若父目录不存在会报错)
hadoop fs -mkdir /test_dir
# 创建多级目录(-p参数自动创建父目录,推荐)
hadoop fs -mkdir -p /hdfs_demo/input
#验证命令
hadoop fs -ls /
![]()
4.上传本地文件到HDFS
# 先在本地创建测试文件
echo "Hello HDFS" > local_test.txt
# 上传本地文件到HDFS的/hdfs_demo/input目录
hadoop fs -put local_test.txt /hdfs_demo/input/
#验证
hadoop fs -ls /hdfs_demo/input

5.查看HDFS文件内容
# 查看HDFS文件内容
hadoop fs -cat /hdfs_demo/input/local_test.txt
![]()
6.追加内容HDFS文件
# 本地创建待追加的内容文件
echo "Append this line" > append_content.txt
# 追加到HDFS文件
hadoop fs -appendToFile append_content.txt /hdfs_demo/input/local_test.txt
# 再次查看验证
hadoop fs -cat /hdfs_demo/input/local_test.txt
![]()
7.复制HDFS中的文件(内部)
# 复制 HDFS 中的 local_test.txt 到 /test_dir 目录(文件名不变)
hadoop fs -cp /hdfs_demo/input/local_test.txt /test_dir/
# 复制并改名(复制到 /test_dir 并命名为 copied_file.txt)
hadoop fs -cp /hdfs_demo/input/local_test.txt /test_dir/copied_file.txt
# 验证:查看 /test_dir 目录
hadoop fs -ls /test_dir


8.移动HDFS中的文件
# 移动 /test_dir/copied_file.txt 到 /hdfs_demo 目录(文件名不变)
hadoop fs -mv /test_dir/copied_file.txt /hdfs_demo/
# 重命名 HDFS 中的文件(将 local_test.txt 改名为 renamed_test.txt)
hadoop fs -mv /hdfs_demo/input/local_test.txt /hdfs_demo/input/renamed_test.txt
# 验证:查看移动和重命名后的结果
hadoop fs -ls /hdfs_demo
hadoop fs -ls /hdfs_demo/input


9.从HDFS下载文件到本地
# 下载 HDFS 中的 renamed_test.txt 到本地当前目录(文件名不变)
hadoop fs -get /hdfs_demo/input/renamed_test.txt ./
# 下载并改名(下载到本地并命名为 downloaded_file.txt)
hadoop fs -get /hdfs_demo/input/renamed_test.txt ./downloaded_file.txt
# 验证:查看本地文件
ls -l ./renamed_test.txt ./downloaded_file.txt
cat ./downloaded_file.txt
![]()
10.删除HDFS中的文件或目录
# 删除 HDFS 中的单个文件
hadoop fs -rm /hdfs_demo/copied_file.txt
# 删除空目录(若目录非空会报错)
hadoop fs -rmdir /test_dir # 需确保 /test_dir 中已无文件
# 强制删除非空目录及所有内容(-r 递归删除,-f 强制不提示)
hadoop fs -rm -r -f /hdfs_demo/input
# 验证:查看根目录,确认文件/目录已删除
hadoop fs -ls /

二、client2--9870端口
1.访问Web UI
Hadoop 3.x 及以上版本:在浏览器输入 http://<namenode-ip>:9870(如 http://192.168.142.131:9870)。
2.网页端操作
进入 Web UI 后,点击顶部菜单 Utilities → Browse the file system

在文件浏览页面,可执行以下操作:
创建文件夹:点击 “新建文件夹” 图标,输入目录名即可。
上传文件:点击 “上传文件” 图标,选择本地文件上传。
删除文件 / 目录:勾选目标文件 / 目录,点击 “删除” 按钮。
返回上级目录:点击 “返回” 图标即可。

三、client3--java操作
1.解压Hadoop,下载 Hadoop 安装包(如 hadoop-3.3.6.tar.gz),解压到本地路径(如 G:\Edge\hadoop-3.3.6)。若解压时提示需要管理员权限,按住 Shift 键右键选择 “以管理员身份解压”。
配置系统环境变量,新建系统变量 HADOOP_HOME,值为G:\Edge\hadoop-3.3.6;编辑系统变量 Path,添加 %HADOOP_HOME%\bin。
下载并放置依赖文件,下载 hadoop.dll 和 winutils.exe。
2.IDEA插件安装与配置
安装 Big Data Tools 插件打开 IDEA → 点击 “File”→“Settings”→“Plugins”→ 搜索 “Big Data Tools”→ 安装后重启 IDEA。
配置 HDFS 连接

可以通过配置文件目录Configuration files directory或者显式 URIExplicit uri来连接

更多推荐
所有评论(0)