一个、hadoop1.1.0演示
- hadoop它适合于大容量数据存储和分布式计算平台
- hadoop核心由hdfs和mapreduce组成
- hdfs这是一个主从结构,仅有一个。是namenode:从节点有非常多个
- 分布式文件系统与HDFS (HDFS体系结构与基本概念)
- Distributed File System
- 数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到很多其它的操作系统管理的磁盘中。可是不方便管理和维护,因此迫切须要一种系统来管理多台机器上 的文件,这就是分布式文件管理系统 。
- 是一种同意文件通过网络在多台主机上分享的文件系统,可让多机器上的多用户分享文件和存储空间。
- 通透性。
让实际上是通过网络来訪问文件的动作。由程序与用户看来。就像是訪问本地的磁盘一般。
- 容错。即使系统中有某些节点脱机,总体来说系统仍然能够持续运作而不会有数据损失。
- 分布式文件管理系统非常多,hdfs仅仅是当中一种。适用于一次写入多次查询的情况,不支持并发写情况,小文件不合适。
二、HDFS的shell操作
- 调用文件系统(FS)Shell命令应使用 bin/hadoop fs 的形式。
- 全部的FS shell命令使用URI路径作为參数。
- URI格式是scheme://authority/path。HDFS的scheme是hdfs,对本地文件系统,scheme是file。
当中scheme和authority參数都是可选的。如果未加指定,就会使用配置中指定的默认scheme。
- 比如:/parent/child能够表示成hdfs://namenode:namenodePort/parent/child。或者更简单的/parent/child(如果配置文件是namenode:namenodePort)
- 大多数FS Shell命令的行为和相应的Unix Shell命令类似。
三、HDFS经常使用命令
-help [cmd] //显示命令的帮助信息-ls(r) <path> //显示当前文件夹下全部文件-du(s) <path> //显示文件夹中全部文件大小-count[-q] <path> //显示文件夹中文件数量-mv <src> <dst> //移动多个文件到目标文件夹-cp <src> <dst> //复制多个文件到目标文件夹-rm(r) //删除文件(夹)-put <localsrc> <dst> //本地文件拷贝到hdfs-copyFromLocal //同put-moveFromLocal //从本地文件移动到hdfs-get [-ignoreCrc] <src> <localdst> //拷贝文件到本地。能够忽略crc校验-getmerge <src> <localdst> //将源文件夹中的全部文件排序合并到一个文件里-cat <src> //在终端显示文件内容-text <src> //在终端显示文件内容-copyToLocal [-ignoreCrc] <src> <localdst>
//拷贝到本地-moveToLocal <src> <localdst>-mkdir <path> //创建目录-touchz <path> //创建一个空文件HDFS 的shell练习hadoop fs -ls / 查看HDFS根文件夹hadoop fs -mkdir /test 在根文件夹创建一个文件夹testhadoop fs -mkdir /test1 在根文件夹创建一个文件夹test1
版权声明:本文博客原创文章。博客,未经同意,不得转载。