一、hadoop1.1.0的介绍

  1.  hadoop是适合大数据的分布式存储和计算的平台
  2.  hadoop核心组成由hdfs和mapreduce组成
  3.  hdfs是主从式结构,主节点只有一个,是namenode:从节点有很多个
  4.  分布式文件系统与HDFS (HDFS体系结构与基本概念)
  5.  Distributed File System
  6.  数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是不方便管理和维护,因此迫切需要一种系统来管理多台机器上  的文件,这就是分布式文件管理系统 。
  7.  是一种允许文件通过网络在多台主机上分享的文件系统,可让多机器上的多用户分享文件和存储空间。
  8.  通透性。让实际上是通过网络来访问文件的动作,由程序与用户看来,就像是访问本地的磁盘一般。
  9.  容错。即使系统中有某些节点脱机,整体来说系统仍然可以持续运作而不会有数据损失。
  10.  分布式文件管理系统很多,hdfs只是其中一种。适用于一次写入多次查询的情况,不支持并发写情况,小文件不合适。

二、HDFS的shell操作

  1. 调用文件系统(FS)Shell命令应使用 bin/hadoop fs 的形式。
  2. 所有的FS shell命令使用URI路径作为参数。
  3. URI格式是scheme://authority/path。HDFS的scheme是hdfs,对本地文件系统,scheme是file。其中scheme和authority参数都是可选的,如果未加指定,就会使用配置中指定的默认scheme。
  4. 例如:/parent/child可以表示成hdfs://namenode:namenodePort/parent/child,或者更简单的/parent/child(假设配置文件是namenode:namenodePort)
  5. 大多数FS Shell命令的行为和对应的Unix Shell命令类似。

三、HDFS常用命令



//显示命令的帮助信息



//显示当前目录下所有文件



//显示目录中所有文件大小



//显示目录中文件数量



//移动多个文件到目标目录



//复制多个文件到目标目录



//删除文件(夹)



//本地文件复制到hdfs



//同put



//从本地文件移动到hdfs



//复制文件到本地,可以忽略crc校验



//将源目录中的所有文件排序合并到一个文件中



//在终端显示文件内容



//在终端显示文件内容





-moveToLocal <src> <localdst>



//创建文件夹



//创建一个空文件



HDFS 的shell练习



hadoop fs -ls /  查看HDFS根目录



hadoop fs -mkdir /test 在根目录创建一个目录test



hadoop fs -mkdir /test1 在根目录创建一个目录test1