Basa
MODEL-RUNNER / LLAMA-CPP
GGUF inference engine underneath most local runners.
model-runnerfreelocal
MACHINE-READABLE
GET /api/v1/resources/llama-cpp