llm-d-workload-variant-autoscaler nightly-0a926fab Public Latest
Workload Variant Autoscaler (WVA) - GPU-aware autoscaler for LLM inference workloads
Install from the command line
Learn more about packages
$ docker pull ghcr.io/llm-d/llm-d-workload-variant-autoscaler:nightly-0a926fab
Recent tagged image versions
- 0 Version downloads
- 1 Version downloads
- 2 Version downloads
- 0 Version downloads
- 6,540 Version downloads
Loading
Sorry, something went wrong.
Details
-
llm-d
- llm-d-autoscaling
- Apache License 2.0
- 57 stars
Last published
2 hours ago
Discussions
1
Issues
152
Total downloads