本文主要是介绍hive库表占用空间大小的命令,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!
1、查每个hive表占用的空间大小
hdfs dfs -du -h /user/hive/warehouse
2、按占用空间大小降序排列
hdfs dfs -du /user/hive/warehouse/ipms.db | sort -nr
3、查某一个分区占用空间大小(单位G)
hadoop fs -ls /user/hive/warehouse/ipms.db/dw_ft_se_nt_u_gen_h/fp_rat=6/stat_month=201709/stat_date=20170903/stat_hour=2017090323|awk -F ' ' '{print $5}'|awk '{a+=$1}END {print a/(1024*1024*1024)}'
4、查某一个表总占用空间大小(单位G)
hadoop fs -du /user/hive/warehouse/ipms.db/dw_ft_se_nt_u_gen_h|awk ' { SUM += $1 } END { print SUM/(1024*1024*1024) }'
5、统计hdfs某个表文件的数据量
hadoop fs -cat /user/hive/warehouse/ipms.db/dw_ft_se_nt_us_cl_h/fp_rat=9/stat_month=202401/stat_date=20240109/stat_hour=2024010906/* | wc -l
6、统计表的大小
hdfs dfs -du -s -h /user/hive/warehouse/ipms.db/dw_msisdn_cell_record_d
这篇关于hive库表占用空间大小的命令的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!