一、WSL2:以管理员身份打开终端输入wsl,进入Ubuntu,输入以下命令:
1、回到根目录
cd ~2、激活sglang-env虚拟环境
source sglang-env/bin/activate3、发现虚拟环境嵌套了,退出 conda base 环境
conda deactivate二、安装SGLang
1、设置国内镜像源
pip config set global.index-url https://pypi.tuna.tsinghua.edu.cn/simple2、安装SGLang(sglang [all] 包体积很大,包含 cuda 依赖,下载 + 编译会比较久,耐心等待,如果报错了就去问AI吧,会帮你一步步解决的)
pip install "sglang[all]" -i https://pypi.tuna.tsinghua.edu.cn/simple3、验证安装,出现下面的信息即代表完成
python -m sglang.launch_server --help三、开始运行模型
1、从魔搭社区下载模型文件(*.safetensors或AWQ格式比较推荐)
2、运行下面的命令启动模型:
sglang serve --model-path /mnt/e/vllm/models/Qwen--Qwen3.5-9B/snapshots/master --host 0.0.0.0 --port 30000 --context-length 131072 --kv-cache-dtype fp8_e4m3 --mem-fraction-static 0.85 --trust-remote-code注:/mnt/e/vllm/models/Qwen--Qwen3.5-9B/snapshots/master是模型文件所在的位置(也就是E盘的vllm/models/Qwen--Qwen3.5-9B/snapshots/master)
拿到地址就可以调用模型了!