$ deploy_vllm ✅ Started `vllm` serving `google/gemma-4-E2B-it`. - image: `vllm/vllm-openai-rocm:nightly-rocm100` - context: 32768, gpu-memory-utilization 0.90 - multimodal: `{"image": 4, "audio": 0}`