Skip to content

04—企业级Hadoop源码二次开发(4)

本讲为 Hadoop 源码二次开发系列第四讲,聚焦 MapReduce 执行引擎源码。

核心内容

  • MRv2 作业提交与初始化流程
  • InputFormat 与切片策略源码
  • Shuffle 与 Sort 机制详解
  • OutputFormat 与结果输出
java
// MapTask 执行示例
public class MapTask extends Task {
    public void run(JobConf job, TaskUmbilicalProtocol umbilical) {
        // 初始化 Reader → 调用 Mapper → 写入 Collector
        MapOutputCollector collector = createSortingCollector(job);
        runNewMapper(job, split, newMapTaskContext, collector);
        collector.flush();
    }
}

资料获取

获取资料课程对应资料课件请关注公众号,并发送 大数据3 获取对应密码

资料链接:https://ug.link/starzy/filemgr/share-download/?id=bigdata-arch-3-04