Skip to content
r/LocalLLaMA Β· Communities

Muse Glimmer on 1/2 AMD v620

Hey. Just tried it on my old ass gpus πŸ˜„ Surprisingly Tensor Split is working on 2 gpus almost doubling PP (wonder how it will work with 4 gpus) Q6 β€” 1 GPU llama-server --model /Muse-Glimmer-30B-GGUF/Muse-Glimmer-30B-UD-Q6_K_XL.gguf --mmproj /Muse-Glimmer-30B-GGUF/mmproj-kquant.gguf --spec-dr