Web-based control panel for self-hosted LLM inference on NVIDIA GPUs — vLLM, MIG, LiteLLM gateway, HTTPS, monitoring.
deployment gpu tts web-interface tti multimodal gpu-management stt-api llm llms vllm llm-deployment vllm-omni vllm-manager gpu-manager vllm-omni-manager
-
Updated
Sep 12, 2026 - Python