[2004 OSDI] MapReduce: Simplified Data Processing on Large Clusters
One-line Summary
Paper Structure Outline
Programming Model

Example Workloads
Word Count

Distributed grep

Reversed Web-Link Graph

Count of URL Access Frequency

Sort

MapReduce Scheduling
Inside MapReduce

The YARN Scheduler

Other Designs
Fault Tolerance: Failures
Fault Tolerance: Stragglers
Locality
Links
Previous[2003 SOSP] The Google File SystemNext[2010 SIGMOD] Pregel: A System for Large-Scale Graph Processing
Last updated