Skip to content

llama : allocate GLM_DSA indexer cache only in "full" indexer layers - #26474

Merged
fairydreaming merged 2 commits into
ggml-org:masterfrom
fairydreaming:glm-lid-cache-filter
Aug 3, 2026
Merged

llama : allocate GLM_DSA indexer cache only in "full" indexer layers#26474
fairydreaming merged 2 commits into
ggml-org:masterfrom
fairydreaming:glm-lid-cache-filter