mapreduce进行Driver测试时的hadoop-common-2.6.0-bin-master.zip压缩包
2021-09-08 09:12:01 1.11MB mapreduce
1
“Hadoop技术内幕”共两册,分别从源代码的角度对“Common+HDFS”和“MapReduce的架构设计和实现原理”进行了极为详细的分析。《Hadoop技术内幕:深入解析MapReduce架构设计与实现原理》由Hadoop领域资深的实践者亲自执笔,首先介绍了MapReduce的设计理念和编程模型,然后从源代码的角度深入分析了RPC框架、客户端、JobTracker、TaskTracker和Task等MapReduce运行时环境的架构设计与实现原理,最后从实际应用的角度深入讲解了Hadoop的性能优化、安全机制、多用户作业调度器和下一代MapReduce框架等高级主题和内容。本书适合Hadoop的二次开发人员、应用开发工程师、运维工程师阅读。
2021-09-06 19:18:33 149.06MB 大数据 hadoop
1
1、Hadoop 业界资讯......................................... - 1 - 2、Nutch + Hadoop 构建商用分布式搜索引擎的问题探究 ........... - 5 - 3、支持自定义爬虫的Nutch segment文件存储接口改写........... - 11 - 4、Nutch中mapreduce应用的几个特殊点 ...................... - 14 - 5、Java RMI + Lucene 构建分布式检索应用初探 ................ - 17 - 6、一对多的表关联在mapreduce中的应用(续) .................. - 26 - 7、InputSplit文件格式分析................................. - 32 - 8、短评:HDFS、MapReduce和HBase三者相辅相成、各有长处 ..... - 34 - 9、HDFS在web开发中的应用................................. - 35 - 10、Mapreduce中value集合的二次排序 ....................... - 38 - 11、Hive SQL手册翻译 ................................... - 47 - 12、Mahout Kmeans简介 .................................... - 57 -
2021-09-06 17:18:56 2.36MB Hadoop HDFS Hive Mahout
能独立熟练完成Hadoop的安装及熟悉Hadoop的配置与管理 熟练地在Hadoop和操作系统以及关系型数据库之前传递数据 能独立制定数据集成方案 熟练地向Hadoop提交作业以及查询作业运行情况 了解Map-Reduce原理,能书写Map-Reduce程序 了解HDFS原理,能熟练地对HDFS中的文件进行管理 能独立完成pig的安装并且利用pig做简单的数据分析工作 能独立完成Hbase的安装和配置 了解Hbase的原理并能进行简单的shell操作 能独立完成Hive的安装和配置 了解Hive的原理及进行HiveQL操作
2021-09-06 17:18:54 1.05MB Hadoop 数据分析平台 云计算 大数据
【Outlines】 Hadoop Overview HDFS Map-reduce Programming Paradigm Hadoop Map-reduce Job Scheduler Resources Hadoop, Why? 数据太多了,需要能存储、快速分析Pb级数据集的系统 单机的存储、IO、内存、CPU有限,需要可扩展的集群 使用门槛低,数据分析是个庞杂的问题,MPI太复杂 单点故障问题 –机器多了单点故障成为正常的异常 –节点有增有减 Hadoop就是一个满足易用性、可靠性、可扩展性的存储计算平台,还是开源的!
2021-09-06 13:13:17 1.05MB 大数据 云计算 Hadoop Mapreduce
一些大数据的习题,关于基础知识和HDFS,MapReduce的 Hadoop是一个由Apache基金会所开发的分布式系统基础架构。
2021-09-03 15:37:35 20KB hadoop HDFS MapReduce
1
MapReduce作业题目文件
2021-09-01 19:06:58 36.22MB mapreduce
1
清华大学-大数据系统基础(B)课件,是学习Hadoop、Spark的不错资源
2021-09-01 16:21:50 61.74MB 大数据 Hadoop Spark MapReduce
1
Hadoop Core
2021-08-27 19:13:48 12KB 大数据 hadoop
1
该数据集为本博主 https://blog.csdn.net/weixin_38201936/article/details/88533223 使用MapReduce对日志进行清洗的数据集,有100 万条数据
2021-08-25 15:34:18 199.11MB 日志数据集
1