r/LocalLLaMA
Β· Communities
Muse Glimmer on 1/2 AMD v620
Hey. Just tried it on my old ass gpus π Surprisingly Tensor Split is working on 2 gpus almost doubling PP (wonder how it will work with 4 gpus) Q6 β 1 GPU llama-server --model /Muse-Glimmer-30B-GGUF/Muse-Glimmer-30B-UD-Q6_K_XL.gguf --mmproj /Muse-Glimmer-30B-GGUF/mmproj-kquant.gguf --spec-dr