mirror of
https://github.com/ggml-org/llama.cpp.git
synced 2026-08-04 00:50:47 -05:00
* Convert vector to f16 for dmmv * compile option * Added compilation option description to README * Changed cmake CUDA_ARCHITECTURES from "OFF" to "native"
9.3 KiB
9.3 KiB