[2020 OSDI] Gavel: Heterogeneity-Aware Cluster Scheduling Policies for Deep Learning Workloads
One-line Summary
Paper Structure Outline
Background & Motivation

Design and Implementation

Allocations as time fractions


Effective throughput

Policies as optimization problems

Realizing the optimal allocation: round-based scheduling + priorities


Evaluation




Links
Previous[2019 SC] ZeRO: memory optimizations toward training trillion parameter modelsNext[2020 OSDI] AntMan: Dynamic Scaling on GPU Clusters for Deep Learning
Last updated