Skip to content

About

Centralized scheduler that runs user-submitted ML training jobs on heterogeneous GPUs, optimizes GPU utilization, handles failures with checkpointing, and provides real-time feedback via a web interface.

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages