Model-first local inference with permissioned hardware inspection and explained CPU/GPU configurations.
cli model-deployment model-runner llm local-inference llama-cpp local-llm local-ai gguf cpu-gpu-offload
-
Updated
Sep 5, 2026 - JavaScript