一、client1--hdfs操作

前提:已经安装好Hadoop并配置好环境;若为分布式集群,需确保各节点间 SSH 免密登录已配置;操作需使用具有 Hadoop 操作权限的用户。

1.启动集群

$HADOOP_HOME/sbin/start-dfs.sh

验证是否成功启动hdfs进程

jps

关闭HDFS集群,用jps验证

$HADOOP_HOME/sbin/stop-dfs.sh

2.单独控制进程
# 示例:启动 NameNode
$HADOOP_HOME/sbin/hadoop-daemon.sh start namenode
# 示例:查看 DataNode 状态
$HADOOP_HOME/sbin/hadoop-daemon.sh status datanode
# 示例:停止 SecondaryNameNode
$HADOOP_HOME/sbin/hadoop-daemon.sh stop secondarynamenode
 
# 新版 HDFS 命令(等效用法)
hdfs --daemon start namenode
hdfs --daemon status datanode
hdfs --daemon stop secondarynamenode

3.文件系统核心操作

创建HDFS目录

# 创建一级目录(若父目录不存在会报错)

hadoop fs -mkdir /test_dir

# 创建多级目录(-p参数自动创建父目录,推荐)

hadoop fs -mkdir -p /hdfs_demo/input

#验证命令

hadoop fs -ls /

4.上传本地文件到HDFS

# 先在本地创建测试文件
echo "Hello HDFS" > local_test.txt
# 上传本地文件到HDFS的/hdfs_demo/input目录
hadoop fs -put local_test.txt /hdfs_demo/input/
#验证
hadoop fs -ls /hdfs_demo/input

5.查看HDFS文件内容

# 查看HDFS文件内容

hadoop fs -cat /hdfs_demo/input/local_test.txt

6.追加内容HDFS文件


# 本地创建待追加的内容文件
echo "Append this line" > append_content.txt
# 追加到HDFS文件
hadoop fs -appendToFile append_content.txt /hdfs_demo/input/local_test.txt
# 再次查看验证
hadoop fs -cat /hdfs_demo/input/local_test.txt

7.复制HDFS中的文件(内部)

# 复制 HDFS 中的 local_test.txt 到 /test_dir 目录(文件名不变)
hadoop fs -cp /hdfs_demo/input/local_test.txt /test_dir/
# 复制并改名(复制到 /test_dir 并命名为 copied_file.txt)
hadoop fs -cp /hdfs_demo/input/local_test.txt /test_dir/copied_file.txt
# 验证:查看 /test_dir 目录
hadoop fs -ls /test_dir

8.移动HDFS中的文件

# 移动 /test_dir/copied_file.txt 到 /hdfs_demo 目录(文件名不变)
hadoop fs -mv /test_dir/copied_file.txt /hdfs_demo/
# 重命名 HDFS 中的文件(将 local_test.txt 改名为 renamed_test.txt)
hadoop fs -mv /hdfs_demo/input/local_test.txt /hdfs_demo/input/renamed_test.txt
# 验证:查看移动和重命名后的结果
hadoop fs -ls /hdfs_demo
hadoop fs -ls /hdfs_demo/input

9.从HDFS下载文件到本地

# 下载 HDFS 中的 renamed_test.txt 到本地当前目录(文件名不变)
hadoop fs -get /hdfs_demo/input/renamed_test.txt ./
# 下载并改名(下载到本地并命名为 downloaded_file.txt)
hadoop fs -get /hdfs_demo/input/renamed_test.txt ./downloaded_file.txt
# 验证:查看本地文件
ls -l ./renamed_test.txt ./downloaded_file.txt
cat ./downloaded_file.txt

10.删除HDFS中的文件或目录


# 删除 HDFS 中的单个文件
hadoop fs -rm /hdfs_demo/copied_file.txt
# 删除空目录(若目录非空会报错)
hadoop fs -rmdir /test_dir  # 需确保 /test_dir 中已无文件
# 强制删除非空目录及所有内容(-r 递归删除,-f 强制不提示)
hadoop fs -rm -r -f /hdfs_demo/input
# 验证:查看根目录,确认文件/目录已删除
hadoop fs -ls /

二、client2--9870端口

1.访问Web UI

Hadoop 3.x 及以上版本:在浏览器输入 http://<namenode-ip>:9870(如 http://192.168.142.131:9870)。

2.网页端操作

 进入 Web UI 后,点击顶部菜单 Utilities → Browse the file system

在文件浏览页面,可执行以下操作:

创建文件夹:点击 “新建文件夹” 图标,输入目录名即可。

上传文件:点击 “上传文件” 图标,选择本地文件上传。

删除文件 / 目录:勾选目标文件 / 目录,点击 “删除” 按钮。

返回上级目录:点击 “返回” 图标即可。

三、client3--java操作

1.解压Hadoop,下载 Hadoop 安装包(如 hadoop-3.3.6.tar.gz),解压到本地路径(如 G:\Edge\hadoop-3.3.6)。若解压时提示需要管理员权限,按住 Shift 键右键选择 “以管理员身份解压”。

配置系统环境变量,新建系统变量 HADOOP_HOME,值为G:\Edge\hadoop-3.3.6;编辑系统变量 Path,添加 %HADOOP_HOME%\bin

下载并放置依赖文件,下载 hadoop.dll 和 winutils.exe。

2.IDEA插件安装与配置

安装 Big Data Tools 插件打开 IDEA → 点击 “File”→“Settings”→“Plugins”→ 搜索 “Big Data Tools”→ 安装后重启 IDEA。

配置 HDFS 连接

可以通过配置文件目录Configuration files directory或者显式 URIExplicit uri来连接

更多推荐