fix: allow mixed turbo/q8_0 KV cache types in CUDA flash-attention selection #11
server.yml
on: pull_request
ubuntu
1m 46s
windows
1m 43s
Annotations
5 errors
|
windows
Canceling since a higher priority waiting request for Server-refs/pull/3/merge-fable5/turbo-fattn-vec-routing exists
|
|
windows
The operation was canceled.
|
|
Server
Canceling since a higher priority waiting request for Server-refs/pull/3/merge-fable5/turbo-fattn-vec-routing exists
|
|
ubuntu
Canceling since a higher priority waiting request for Server-refs/pull/3/merge-fable5/turbo-fattn-vec-routing exists
|
|
ubuntu
The operation was canceled.
|