Skip to content
llama.cpp releases · Infrastructure

b10025

cuda : relax tensor contiguity requirements for quantized concat (#25678) cuda : relax tensor contiguity requirements for quantized concat tests : add test cases for non-contiguous quantized concat ggml : relax contiguity requirements for quantized concat Co-authored-by: Stanisław Szymczyk sszymczy@gmail.com macOS/iOS: