大数据

  • 如何系统的了解Kafka详解大数据

    1.概述 在大数据的浪潮下,时时刻刻都会产生大量的数据。比如社交媒体、博客、电子商务等等,这些数据会以不同的类型存储在不同的平台里面。为了执行ETL(提取、转换、加载)操作,需要一个消息中间件系统,该系统…

    大数据 2022年1月11日
  • Kafka2.8安装详解大数据

    1.概述 最近Kafka官网发布了2.8版本,在该版本中引入了KRaft模式。鉴于新版本和新特性的引入,相关使用资料较少,那边本篇博客笔者将为大家介绍Kafka2.8的安装和使用。 2.内容 2.1  版本介绍 2.1.1 目的 从Kaf…

    大数据 2022年1月11日
  • Hadoop社区版搭建详解大数据

    1.环境准备 1.1 硬件配置 设备名 参数 数量 6台 系统 centos6.5 内存 64G 硬盘 32T/台 CPU 16核/台 1.2 软件版本 Hadoop-2.x 下载地址 JDK1.7  下载地址 至此搭建Hadoop集群的条件准备OK了。 2.创建Hadoo…

    大数据 2022年1月11日
  • Hadoop项目开发笔录详解大数据

    1.概要 我打算分享一下,我开发Hadoop的一些心得,对于即将步入Hadoop行业的童鞋,希望我整理的这些博文对您有帮助,我打算分为以下几部分来描述。 2.步骤   注:点击链接可直接跳到指定位置 Hadoop社区版集群…

    大数据 2022年1月11日
  • Hive的安装部署详解大数据

    1.环境准备 1.1软件版本 hive-0.14 下载地址 2.配置 安装hive的前提,必需安装好hadoop环境,可以参考我之前Hadoop社区版搭建,先搭建好hadoop环境;接下来我们开始配置hive 2.1环境变量 sudo vi /etc/profile HIVE…

    大数据 2022年1月11日
  • SQOOP安装部署详解大数据

    1.环境准备 1.1软件版本 sqoop-1.4.5 下载地址 2.配置 sqoop的配置比较简单,下面给出需要配置的文件 2.1环境变量 sudo vi /etc/profile SQOOP_HOME=/home/hadoop/source/sqoop-1.4.5 PATH=$SQOOP_HOME/bin export …

    大数据 2022年1月11日
  • hadoop家族成员详解大数据

    1.概述   使用hadoop已经有一段时间了,从最开始懵懂到迷茫,再到各种阅读与写作,再到如今各种组合应用,逐渐已经离不开hadoop了,hadoop在大数据行业的成功,加速了它本身的发展,各大社区都能见到hadoop的身影…

    大数据 2022年1月11日
  • hbase和zookeeper的安装和部署详解大数据

    1.概要 1.1HBase的使用场景  大数据量 (100s TB级数据) 且有快速随机访问的需求。  例如淘宝的交易历史记录。数据量巨大无容置疑,面向普通用户的请求必然要即时响应。  容量的优雅扩展。  大数据的驱使,动…

    大数据 2022年1月11日
  • 网站日志统计案例分析与实现详解大数据

    1.概要     到这一步,若是按照前面到文章一步走来,不出意外,我想hadoop平台环境应该搭建OK了。下面我以自己工作中实际的案例来梳理一下整个流程。同时参考一些其他的文章来分析,由于很多网站的日志KP…

    大数据 2022年1月11日
  • 那些年使用Hive踩过的坑详解大数据

    1.概述   这个标题也是用血的教训换来的,希望对刚进入hive圈的童鞋和正在hive圈爬坑的童鞋有所帮助。打算分以下几个部分去描述: Hive的结构 Hive的基本操作 Hive Select Hive Join Hive UDF Hive的M/R 使用Hive…

    大数据 2022年1月11日