SGLang框架运行本地部署的qwen3.5:9b模型
2026/9/12 19:43:02 网站建设 项目流程

一、WSL2:以管理员身份打开终端输入wsl,进入Ubuntu,输入以下命令:

1、回到根目录

cd ~

2、激活sglang-env虚拟环境

source sglang-env/bin/activate

3、发现虚拟环境嵌套了,退出 conda base 环境

conda deactivate

二、安装SGLang

1、设置国内镜像源

pip config set global.index-url https://pypi.tuna.tsinghua.edu.cn/simple

2、安装SGLang(sglang [all] 包体积很大,包含 cuda 依赖,下载 + 编译会比较久,耐心等待,如果报错了就去问AI吧,会帮你一步步解决的)

pip install "sglang[all]" -i https://pypi.tuna.tsinghua.edu.cn/simple

3、验证安装,出现下面的信息即代表完成

python -m sglang.launch_server --help

三、开始运行模型

1、从魔搭社区下载模型文件(*.safetensors或AWQ格式比较推荐)

2、运行下面的命令启动模型:

sglang serve --model-path /mnt/e/vllm/models/Qwen--Qwen3.5-9B/snapshots/master --host 0.0.0.0 --port 30000 --context-length 131072 --kv-cache-dtype fp8_e4m3 --mem-fraction-static 0.85 --trust-remote-code

注:/mnt/e/vllm/models/Qwen--Qwen3.5-9B/snapshots/master是模型文件所在的位置(也就是E盘的vllm/models/Qwen--Qwen3.5-9B/snapshots/master)

拿到地址就可以调用模型了!

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询