数据采集

  • 高可用Hadoop平台-探索详解大数据

    1.概述   上篇《高可用Hadoop平台-启航》博客已经让我们初步了解了Hadoop平台;接下来,我们对Hadoop做进一步的探索,一步一步的揭开Hadoop的神秘面纱。下面,我…

    大数据 2022年1月11日
  • Hive基本操作详解大数据

    1.概述   上一章《那些年使用Hive踩过的坑》介绍了Hive的基本架构及原理,加下来介绍Hive的基本操作和一些注意事项。 2.基本操作 2.1Create Table 2.1…

    大数据 2022年1月11日
  • Hive性能优化详解大数据

    1.概述   继续《那些年使用Hive踩过的坑》一文中的剩余部分,本篇博客赘述了在工作中总结Hive的常用优化手段和在工作中使用Hive出现的问题。下面开始本篇文章的优化介绍。 2…

    大数据 2022年1月11日
  • 高可用Hadoop平台-运行MapReduce程序详解大数据

    1.概述   最近有同学反应,如何在配置了HA的Hadoop平台运行MapReduce程序呢?对于刚步入Hadoop行业的同学,这个疑问却是会存在,其实仔细想想,如果你之前的语言功…

    大数据 2022年1月11日
  • 高可用Hadoop平台-集成Hive HAProxy详解大数据

    1.概述   这篇博客是接着《高可用Hadoop平台》系列讲,本篇博客是为后面用 Hive 来做数据统计做准备的,介绍如何在 Hadoop HA 平台下集成高可用的 Hive 工具…

    大数据 2022年1月11日
  • 高可用Hadoop平台-实战详解大数据

    1.概述   今天继续《高可用的Hadoop平台》系列,今天开始进行小规模的实战下,前面的准备工作完成后,基本用于统计数据的平台都拥有了,关于导出统计结果的文章留到后面赘述。今天要…

    大数据 2022年1月11日
  • 高可用Hadoop平台-实战尾声篇详解大数据

    1.概述   今天这篇博客就是《高可用Hadoop平台》的尾声篇了,从搭建安装到入门运行 Hadoop 版的 HelloWorld(WordCount 可以称的上是 Hadoop …

    大数据 2022年1月11日
  • 高可用Hadoop平台-答疑篇详解大数据

    1.概述   这篇博客不涉及到具体的编码,只是解答最近一些朋友心中的疑惑。最近,一些朋友和网友纷纷私密我,我总结了一下,疑问大致包含以下几点: 我学 Hadoop 后能从事什么岗位…

    大数据 2022年1月11日
  • Hadoop2源码分析-准备篇详解大数据

    1.概述   我们已经能够搭建一个高可用的Hadoop平台了,也熟悉并掌握了一个项目在Hadoop平台下的开发流程,基于Hadoop的一些套件我们也能够使用,并且能利用这些套件进行…

    大数据 2022年1月11日
  • Hadoop2源码分析-Hadoop V2初识详解大数据

    1.概述   在完成分析Hadoop2源码的准备工作后,我们进入到后续的源码学习阶段。本篇博客给大家分享,让大家对Hadoop V2有个初步认识,博客的目录内容如下所示: Hado…

    大数据 2022年1月11日