Popular repositories Loading
Repositories
Showing 10 of 62 repositories
- autoparallel Public
An experimental implementation of compiler-driven automatic sharding of models across a given device mesh.
- tritonbench Public
Tritonbench is a collection of PyTorch custom operators with example inputs to measure their performance.
-
- flex_shard Public
Flexible parameter sharding and distributed optimization utilities for PyTorch training
-
-