val value: RDD[String] = sc.newAPIHadoopFile[LongWritable, Text, TextInputFormat](path)
 .asInstanceOf[NewHadoopRDD[LongWritable, Text]]
 .mapPartitionsWithInputSplit(
  (inputSplit: InputSplit, iterator: Iterator[(LongWritable, Text)]) => {
   val file = inputSplit.asInstanceOf[FileSplit]
   val fileName = file.getPath.getName
   iterator.map(line => {
    //将文件名添加到rdd的结尾
    line._2.toString + fileName
   })
  })
 

更多推荐