r/LocalLLaMA
· Communities
POCKET-35B agentic model on cpu 59 t/s
https://huggingface.co/FINAL-Bench/POCKET-35B-GGUF A 35B model that runs on your PC with no GPU — and on your phone. Just stock llama.cpp. No fork, no CUDA, no cloud. The POCKET lineup — pick by your device Repo File Size Runs on Best for Korean PPL* POCKET-35B-GGUF Q4_K_M 21 GB PC / server (32 GB RAM) top quality 5.79