[BugFix]Add int8 cache dtype when using ascend attention quantization · vllm-project/vllm-ascend@ccf101a

Triggered via pull request February 21, 2025 01:47

Angazenn

synchronize #125

Angazenn:develop

Status Success

Total duration 27m 44s

Artifacts 1

image.yml

on: pull_request

Produced during runtime

Name	Size
vllm-project~vllm-ascend~XZ4DJU.dockerbuild	244 KB