本次共找到 231hadoop 相关的文章

4年前
java Api 读取HDFS文件内容
packagedao;importorg.apache.hadoop.conf.Configuration;importorg.apache.hadoop.fs.;importjava.io.;publicclassHDFSApi{/
4年前
Hadoop使用学习笔记(1)
Hadoop使用学习笔记1.Hadoop安装与基本概念Hadoop发行版本地址(https://www.oschina.net/action/GoToLink?urlhttp%3A%2F%2Fhadoop.apache.org%2Freleases.html)1.1环境配置需
4年前
Hive出现拒绝连接ConnectionRefused 解决
Causedby:java.net.ConnectException:CallFromnn1.hadoop/192.168.10.6tonn2.hadoop:9000failedonconnectionexception:java.net.ConnectException:拒绝连接;Formoredetailssee:
4年前
Ambari——大数据平台的搭建利器
Ambari是什么Ambari跟Hadoop等开源软件一样,也是ApacheSoftwareFoundation中的一个项目,并且是顶级项目。目前最新的发布版本是2.0.1,未来不久将发布2.1版本。就Ambari的作用来说,就是创建、管理、监视Hadoop的集群,但是这里的Hadoop是广义,指的
4年前
Hadoop 新 MapReduce 框架 Yarn 详解
HadoopMapReduceV2(Yarn)框架简介原HadoopMapReduce框架的问题对于业界的大数据存储及分布式处理系统来说,Hadoop是耳熟能详的卓越开源分布式文件存储及处理框架,对于Hadoop框架的介绍在此不再累述,读者可参考Hadoop官方简介(https://www.oschina.net/action
4年前
Hbase javaAPI(工具类)表的增删改查
建立连接:packageInit;importorg.apache.hadoop.conf.Configuration;importorg.apache.hadoop.hbase.;importorg.apache.hadoop.hbase.client.;importja
4年前
Hadoop压缩
一、Hadoop压缩简介1、hadoop的3个阶段(1)分布式文件系统HDFS(2)分布式编程框架MapReduce(3)yarn框架2、Hadoop数据压缩MR操作过程中进行大量数据传输。压缩技术能够有效的减少底层存储(HDFS)读写字
4年前
Hadoop是一种开源的适合大数据的分布式存储和处理的平台
“Hadoop能做什么?”,概括如下:  1)搜索引擎:这也正是DougCutting设计Hadoop的初衷,为了针对大规模的网页快速建立索引;  2)大数据存储:利用Hadoop的分布式存储能力,例如数据备份、数据仓库等;  3)大数据处理:利用Hadoop的分布式处理能力,例如数据挖掘、数据分析等;  4)
4年前
Hadoop完整搭建过程(二):伪分布模式
1伪分布模式伪分布模式是运行在单个节点以及多个Java进程上的模式。相比起本地模式,需要进行更多配置文件的设置以及ssh、YARN相关设置。2Hadoop配置文件修改Hadoop安装目录下的三个配置文件:etc/hadoop/coresite.xmle
4年前
Hadoop之Shell脚本自动启动
在用Hadoop进行大数据分析处理时,通常配置的服务器不止一两台。为了减少人工操作的重复性,所以hadoop提供了可以自动启动Hadoop集群的Shell脚本。在使用Shell脚本启动集群之前,需要进行相应的配置。说明:$HADOOP\_HOME/root/project/hadoop(根据自己配置的路径不同而不同)打开$HADOOP\_H
4年前
Maven添加jar包到 Ubuntu本地中心仓库
中心仓库中的jar包如下:<!https://mvnrepository.com/artifact/org.apache.hadoop/hadoopaws<dependency  <groupIdorg.apache.hadoop</groupId  <artifactIdhado
4年前
Hadoop伪分布式环境搭建之Linux操作系统安装
Hadoop伪分布式环境搭建之Linux操作系统安装本篇文章是接上一篇《超详细hadoop虚拟机安装教程(附图文步骤)》,上一篇有人问怎么没写hadoop安装。在文章开头就已经说明了,hadoop安装会在后面写到,因为整个系列的文章涉及到每一步的截图,导致文章整体很长。会分别先对虚拟机的安装、Linux系统安装进行介绍,然后才会写到had
4年前
Spark源码剖析
4. Hadoop相关配置及Executor环境变量的设置4.1 Hadoop相关配置信息默认情况下,Spark使用HDFS作为分布式文件系统,所以需要获取Hadoop相关配置信息的代码如下:!(https://oscimg.oschina.net/
4年前
Apache Hadoop 2.4.1 命令参考
概述所有的Hadoop命令都是通过bin/hadoop目录下的脚本所执行,在没有任何参数的情况下运行Hadoop脚本将打印该命令描述。Usage:Hadoop \configconfdir\\COMMAND\\GENERIC\_OPTIONS\\COMMAND\_OPTIONS\hadoop有个输入选项解析框
4年前
Linux 搭建Hadoop集群错误锦集
一、Hadoop集群配置好后,执行startdfs.sh后报错,一堆permissiondeniedzfsbin$./startdfs.shStartingnamenodesonmastermaster:chown:changingownershipof'/home/zf/hadoop/hado
4年前
Linux命令集合
groupadd&&useradd创建一个普通用户hadoop,属于hadoop组,设置密码,管理员权限,自动创建home目录groupaddhadoopuseraddmphadooprghadoophadoop修改密码对于普通用户:
4年前
Python大数据分析(二):大数据技术基础
文章目录(一)Linux系统和大数据(二)Hadoop(1)Hadoop包含哪些模块?(2)Hadoop的生态成员(3)哪些人在使用Hadoop?(三)Spark(1)Scala(2)RDD(3)主件(四)云计算(1)虚拟化技术
4年前
Hbase的java_API操作
package Hbase;import java.io.IOException;import org.apache.hadoop.conf.Configuration;import org.apache.hadoop.hbase.HBaseConfiguration;import org.apache.had
4年前
Java_Habse_add
1importjava.io.IOException;2importorg.apache.hadoop.conf.Configuration;3importorg.apache.hadoop.hbase.HBaseConfiguration;4importorg.apache.hadoop
4年前
MapReduce例程
TemperatureMR.javapackage cn.kissoft.hadoop.week05;import org.apache.hadoop.fs.Path;import org.apache.hadoop.io.IntWritable;import org.apache.hadoop.i