Serve the pinned upstream GGML server on vulkan/cuda/cpu
Some checks failed
CI / flake (pull_request) Failing after 5s
fix: make GPU-backed Qwen startup fail-safe
Some checks failed
CI / flake (pull_request) Failing after 5s
Add AMD ROCm support and generic voice service tooling
Some checks failed
CI / flake (pull_request) Failing after 5s