大数据:Hadoop(JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作)

时间:2022-01-13 15:39:02
  • 所有的内容都来源与 Hadoop 官方文档

一、Hadoop 伪分布式安装步骤

 1)JDK安装

  • 解压:tar -zxvf jdk-7u79-linux-x64.tar.gz -C ~/app
  • 添加到系统环境变量
  1. ~/.bash_profile
  2. export JAVA_HOME=/home/hadoop/app/jdk1.7.0_79
  3. export PATH=$TAVA_HOME/bin:$PATH
  • 环境变量生效:source ~/bash_profile
  • 验证Java是否配置成功:java -v

 2)ssh安装

二、HDFS伪分布式环境搭建

 1)下载并解压hadoop

  • 下载:cdh网站下载
  • 解压:tar -zxvf hadoop-2.6.0-cdh5.7.0.tar.gz -C ~/app

 2)修改 Hadoop 配置文件

  • 在 hadoop_home/etc/hadoop 目录下修改
  • 配置 hadoop-env.sh 文件

  1. 配置:export JAVA_HOME=/home/hadoop/app/jdk1.7.0_79
  • 配置 cor-site.xml 及 hdfs-site.xml 文件

  • cor-site.xml 中,默认的数据存放在临时文件夹,需要添加新的属性(hadoop.tmp.dir),可以指定存放的文件夹(如存放在文件夹 /home/hadoop/app 中),防止数据在每次重启系统时被删除;
  • 大数据:Hadoop(JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作)
  • 配置 slaves 文件:用于添加素有 DataNode 的名字;

 3)启动 hdfs

  • 格式化文件系统(在客户端操作,且仅第一次执行即可,不要重复执行):hdfs namenode -format,或者 hadoop namenode -format
  • 启动 hdfs:(sbin 目录下)sbin/start-dfs.sh
  • 验证是否启动成功:
  1. 大数据:Hadoop(JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作)
  2. 3 个进程,如果缺少,说明缺少的部分配置不成功;(可通过日志输出查看进程的启动过程)
  • 浏览器访问方式:http://localhost:50070

 4)停止 hdfs

  • (在 sbin 目录下)sbin/stop-dfs.sh

三、HDFS 的shell 操作

  • hdfs dfs + commands 或者 hadoop fs + commands

  • 用法与 Linux 命令相同

  • 大数据:Hadoop(JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作)
  • 例:

  1. hadoop fs -put hello.txt:将文件 hello.txt 从本地传到 HDFS 上;
  2. hadoop fs -get hello.txt:从 HDFS 上获取文件 hello.txt 到本地;
  3. hadoop fs -text /hello.txt:查看文件 hello.txt 的内容;
  4. hadoop fs -mkdir /test:在 HDFS 上创建一个目录 test;
  5. hadoop fs -mkdir -p /test/a/b:在 HDFS 上创建递归文件夹;
  6. hadoop fs -rm /hello.txt:删除一个文件;(-rm 不能删除文件夹,只能删除文件)
  7. hadoop fs -rm -R /test:删除文件夹 test 及其下所有递归文件;
  8. hadoop fs -ls -R:查看递归文件夹;
  • 大数据:Hadoop(JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作)

大数据:Hadoop(JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作)的更多相关文章

  1. HDFS伪分布式环境搭建

    (一).HDFS shell操作 以上已经介绍了如何搭建伪分布式的Hadoop,既然环境已经搭建起来了,那要怎么去操作呢?这就是本节将要介绍的内容: HDFS自带有一些shell命令,通过这些命令我们 ...

  2. 大数据hadoop入门学习之集群环境搭建集合

    目录: 1.基本工作准备 1.虚拟机准备 2.java 虚拟机-jdk环境配置 3.ssh无密码登录 2.hadoop的安装与配置 3.hbase安装与配置(集成安装zookeeper) 4.zook ...

  3. Hadoop学习笔记1:伪分布式环境搭建

    在搭建Hadoop环境之前,请先阅读如下博文,把搭建Hadoop环境之前的准备工作做好,博文如下: 1.CentOS 6.7下安装JDK , 地址: http://blog.csdn.net/yule ...

  4. Hadoop 2.7 伪分布式环境搭建

    1.安装环境 ①.一台Linux CentOS6.7 系统 hostname                ipaddress              subnet mask             ...

  5. 【Hadoop】伪分布式环境搭建、验证

    Hadoop伪分布式环境搭建: 自动部署脚本: #!/bin/bash set -eux export APP_PATH=/opt/applications export APP_NAME=Ares ...

  6. CentOS7下Hadoop伪分布式环境搭建

    CentOS7下Hadoop伪分布式环境搭建 前期准备 1.配置hostname(可选,了解) 在CentOS中,有三种定义的主机名:静态的(static),瞬态的(transient),和灵活的(p ...

  7. 【Hadoop离线基础总结】CDH版本Hadoop 伪分布式环境搭建

    CDH版本Hadoop 伪分布式环境搭建 服务规划 步骤 第一步:上传压缩包并解压 cd /export/softwares/ tar -zxvf hadoop-2.6.0-cdh5.14.0.tar ...

  8. Hadoop2.5.0伪分布式环境搭建

    本章主要介绍下在Linux系统下的Hadoop2.5.0伪分布式环境搭建步骤.首先要搭建Hadoop伪分布式环境,需要完成一些前置依赖工作,包括创建用户.安装JDK.关闭防火墙等. 一.创建hadoo ...

  9. hive-2.2.0 伪分布式环境搭建

    一,实验环境: 1, ubuntu server 16.04 2, jdk,1.8 3, hadoop 2.7.4 伪分布式环境或者集群模式 4, apache-hive-2.2.0-bin.tar. ...

随机推荐

  1. windows server 2008 wamp安装报000F15A0解决方法

    wampserver2.2c-x64 原因:缺少Visual C++ 2008 Runtime x64,官网地址http://www.microsoft.com/zh-cn/download/deta ...

  2. 【poj2960】 S-Nim

    http://poj.org/problem?id=2960 (题目链接) 题意 经典Nim游戏,只是给出了一个集合S,每次只能取S[i]个石子. Solution ${g(x)=mex\{SG(x- ...

  3. jquery id选择器 id带"."问题

    例如控件ID为user.id 使用$("#user.id")不能得到正确的结果 必须使用\\转义 即$("#user\\.id")

  4. [RouterOS] ROS对接碧海威或PA等流控实现完美流控详细教程(附脚本全免费)

    前言: 经常在群里看到不少朋友争论海蜘蛛 ROS 维盟 爱快 碧海威 流控大师 Woyos等等软路由,哪个好.实际上,网络产品是复杂的,现在的软路由功能上已经远远不是单独的路由了.每种产品都有他本身的 ...

  5. DIV的垂直居中

    一直以来都没有找到一种完美解决DIV垂直居中的方法,今天终于找到了,特记录如下,从此不再用table来居中了.^^ <html> <style> #image{ width:5 ...

  6. 【Andorid开发框架学习】之Mina开发之客户端开发

    昨天我们讲到了Mina的基本知识点.如果还有不懂得同学可以看一下我昨天的博客.http://www.cnblogs.com/getherBlog/p/3934927.html今天我着重来讲一下基于Mi ...

  7. 飞信免费发送接口API的测试 httpClient

    测试飞信免费发送接口API的测试(HTTPClient实现) 使用优点:快捷,方便 使用缺点:用户的各种信息以明文形式在网络中传输不安全. 仅仅用于测试 package cn.com.vnvtrip. ...

  8. PHP Cookies

    PHP Cookies cookie 常用于识别用户. Cookie 是什么? cookie 常用于识别用户.cookie 是一种服务器留在用户计算机上的小文件.每当同一台计算机通过浏览器请求页面时, ...

  9. line-height系列(二)——对行内元素(文字、图片、兄弟元素)、块级元素设置line-height后的表现

    >原创文章,转载请注明来源! 二.对行内元素(文字.图片.兄弟元素).块级元素设置line-height后的表现 对块级元素无效,对行内元素有效.可继承给行内元素. 文字的line-height ...

  10. Linux系统调用的运行过程【转】

    本文转自:http://blog.csdn.net/kernel_learner/article/details/7331505 在Linux中,系统调用是用户空间访问内核的唯一手段,它们是内核唯一的 ...