新聞中心
命令基本格式:
hadoop fs/dfs -cmd < args >
1.ls
hadoop fs -ls /
列出hdfs文件系統(tǒng)根目錄下的目錄和文件
站在用戶的角度思考問題,與客戶深入溝通,找到寧河網(wǎng)站設(shè)計(jì)與寧河網(wǎng)站推廣的解決方案,憑借多年的經(jīng)驗(yàn),讓設(shè)計(jì)與互聯(lián)網(wǎng)技術(shù)結(jié)合,創(chuàng)造個(gè)性化、用戶體驗(yàn)好的作品,建站類型包括:成都做網(wǎng)站、成都網(wǎng)站設(shè)計(jì)、企業(yè)官網(wǎng)、英文網(wǎng)站、手機(jī)端網(wǎng)站、網(wǎng)站推廣、域名申請(qǐng)、雅安服務(wù)器托管、企業(yè)郵箱。業(yè)務(wù)覆蓋寧河地區(qū)。
hadoop fs -ls -R /
列出hdfs文件系統(tǒng)所有的目錄和文件
2.put
hadoop fs -put < local file > < hdfs file >
hdfs file的父目錄一定要存在,否則命令不會(huì)執(zhí)行
hadoop fs -put < local file or dir >...< hdfs dir >
hdfs dir 一定要存在,否則命令不會(huì)執(zhí)行
hadoop fs -put - < hdsf file>
從鍵盤讀取輸入到hdfs file中,按Ctrl+D結(jié)束輸入,hdfs file不能存在,否則命令不會(huì)執(zhí)行
2.1.moveFromLocal
hadoop fs -moveFromLocal < local src > ... < hdfs dst >
與put相類似,命令執(zhí)行后源文件 local src 被刪除,也可以從從鍵盤讀取輸入到hdfs file中
2.2.copyFromLocal
hadoop fs -copyFromLocal < local src > ... < hdfs dst >
與put相類似,也可以從從鍵盤讀取輸入到hdfs file中
3.get
hadoop fs -get < hdfs file > < local file or dir>
local file不能和 hdfs file名字不能相同,否則會(huì)提示文件已存在,沒有重名的文件會(huì)復(fù)制到本地
hadoop fs -get < hdfs file or dir > ... < local dir >
拷貝多個(gè)文件或目錄到本地時(shí),本地要為文件夾路徑
注意:如果用戶不是root, local 路徑要為用戶文件夾下的路徑,否則會(huì)出現(xiàn)權(quán)限問題,
3.1.moveToLocal
當(dāng)前版本中還未實(shí)現(xiàn)此命令
3.2.copyToLocal
hadoop fs -copyToLocal < local src > ... < hdfs dst >
與get相類似
4.rm
hadoop fs -rm < hdfs file > ... hadoop fs -rm -r < hdfs dir>...
每次可以刪除多個(gè)文件或目錄
5.mkdir
hadoop fs -mkdir < hdfs path>
只能一級(jí)一級(jí)的建目錄,父目錄不存在的話使用這個(gè)命令會(huì)報(bào)錯(cuò)
hadoop fs -mkdir -p < hdfs path>
所創(chuàng)建的目錄如果父目錄不存在就創(chuàng)建該父目錄
6.getmerge
hadoop fs -getmerge < hdfs dir > < local file >
將hdfs指定目錄下所有文件排序后合并到local指定的文件中,文件不存在時(shí)會(huì)自動(dòng)創(chuàng)建,文件存在時(shí)會(huì)覆蓋里面的內(nèi)容
hadoop fs -getmerge -nl < hdfs dir > < local file >
加上nl后,合并到local file中的hdfs文件之間會(huì)空出一行
7.cp
hadoop fs -cp < hdfs file > < hdfs file >
目標(biāo)文件不能存在,否則命令不能執(zhí)行,相當(dāng)于給文件重命名并保存,源文件還存在
hadoop fs -cp < hdfs file or dir >... < hdfs dir >
目標(biāo)文件夾要存在,否則命令不能執(zhí)行
8.mv
hadoop fs -mv < hdfs file > < hdfs file >
目標(biāo)文件不能存在,否則命令不能執(zhí)行,相當(dāng)于給文件重命名并保存,源文件不存在
hadoop fs -mv < hdfs file or dir >... < hdfs dir >
源路徑有多個(gè)時(shí),目標(biāo)路徑必須為目錄,且必須存在。
注意:跨文件系統(tǒng)的移動(dòng)(local到hdfs或者反過來)都是不允許的
9.count
hadoop fs -count < hdfs path >
統(tǒng)計(jì)hdfs對(duì)應(yīng)路徑下的目錄個(gè)數(shù),文件個(gè)數(shù),文件總計(jì)大小
顯示為目錄個(gè)數(shù),文件個(gè)數(shù),文件總計(jì)大小,輸入路徑
10.du
hadoop fs -du < hdsf path>
顯示hdfs對(duì)應(yīng)路徑下每個(gè)文件夾和文件的大小
hadoop fs -du -s < hdsf path>
顯示hdfs對(duì)應(yīng)路徑下所有文件和的大小
hadoop fs -du - h < hdsf path>
顯示hdfs對(duì)應(yīng)路徑下每個(gè)文件夾和文件的大小,文件的大小用方便閱讀的形式表示,例如用64M代替67108864
11.text
hadoop fs -text < hdsf file>
將文本文件或某些格式的非文本文件通過文本格式輸出
12.setrep
hadoop fs -setrep -R 3 < hdfs path >
改變一個(gè)文件在hdfs中的副本個(gè)數(shù),上述命令中數(shù)字3為所設(shè)置的副本個(gè)數(shù),-R選項(xiàng)可以對(duì)一個(gè)人目錄下的所有目錄+文件遞歸執(zhí)行改變副本個(gè)數(shù)的操作
13.stat
hdoop fs -stat [format] < hdfs path >
返回對(duì)應(yīng)路徑的狀態(tài)信息
[format]可選參數(shù)有:%b(文件大?。?o(Block大?。?,%n(文件名),%r(副本個(gè)數(shù)),%y(最后一次修改日期和時(shí)間)
可以這樣書寫hadoop fs -stat %b%o%n < hdfs path >,不過不建議,這樣每個(gè)字符輸出的結(jié)果不是太容易分清楚
14.tail
hadoop fs -tail < hdfs file >
在標(biāo)準(zhǔn)輸出中顯示文件末尾的1KB數(shù)據(jù)
15.archive
hadoop archive -archiveName name.har -p < hdfs parent dir > < src >* < hdfs dst >
命令中參數(shù)name:壓縮文件名,自己任意取;< hdfs parent dir > :壓縮文件所在的父目錄;< src >:要壓縮的文件名;< hdfs dst >:壓縮文件存放路徑
*示例:hadoop archive -archiveName hadoop.har -p /user 1.txt 2.txt /des
示例中將hdfs中/user目錄下的文件1.txt,2.txt壓縮成一個(gè)名叫hadoop.har的文件存放在hdfs中/des目錄下,如果
1.txt,2.txt不寫就是將/user目錄下所有的目錄和文件壓縮成一個(gè)名叫hadoop.har的文件存放在hdfs中/des目錄下
顯示har的內(nèi)容可以用如下命令:
hadoop fs -ls /des/hadoop.jar
顯示har壓縮的是那些文件可以用如下命令
hadoop fs -ls -R har:///des/hadoop.har
注意:har文件不能進(jìn)行二次壓縮。如果想給.har加文件,只能找到原來的文件,重新創(chuàng)建一個(gè)。har文件中原來文件的數(shù)據(jù)并沒有變化,har文件真正的作用是減少NameNode和DataNode過多的空間浪費(fèi)。
16.balancer
hdfs balancer
如果管理員發(fā)現(xiàn)某些DataNode保存數(shù)據(jù)過多,某些DataNode保存數(shù)據(jù)相對(duì)較少,可以使用上述命令手動(dòng)啟動(dòng)內(nèi)部的均衡過程
17.dfsadmin
hdfs dfsadmin -help
管理員可以通過dfsadmin管理HDFS,用法可以通過上述命令查看
hdfs dfsadmin -report
顯示文件系統(tǒng)的基本數(shù)據(jù)
hdfs dfsadmin -safemode < enter | leave | get | wait >
enter:進(jìn)入安全模式;leave:離開安全模式;get:獲知是否開啟安全模式;
wait:等待離開安全模式
18.distcp
用來在兩個(gè)HDFS之間拷貝數(shù)據(jù)
網(wǎng)站標(biāo)題:hadoophdfs命令
文章鏈接:http://www.dlmjj.cn/article/jhhihs.html