Running vLLM natively on Windows
vLLM officially supports Linux only. On Windows the usual answer is WSL or Docker. I wanted it running natively, with real CUDA kernels and an OpenAI-compatible server, and no Linux layer. So I mainta
aivrar.hashnode.dev6 min read