优云智算
控制台
立即注册

vllm-qwen3.8-27b

vllm-qwen3.8-27b

镜像大小
58 GB
当前版本
v1.0
累计部署
1
累计运行
0 h
最近更新
2026-08-27

运行环境

框架版本
PyTorch-2.13.0
CUDA版本
13.2
应用
JupyterLab: 8888
自定义开放端口
8080
支持卡型
RTX50系

启动说明

注意要双卡

1. 启动 vllm

新建一个终端:

CUDA_VISIBLE_DEVICES=0,1 \
vllm serve /model/ModelScope/Qwen/Qwen3.8-27B-FP8 \
  --served-model-name qwen3.8-27b \
  --host 0.0.0.0 \
  --port 8000 \
  -tp 2 \
  --max-model-len 32768 \
  --gpu-memory-utilization 0.90 \
  --reasoning-parser qwen3 \
  --enable-auto-tool-choice \
  --tool-call-parser qwen3_coder

保持该终端运行。

2. 启动 Open WebUI

再新建一个终端:

open-webui serve --host 0.0.0.0 --port 8080

保持该终端运行。

3. 使用

浏览器打开 Open WebUI,网址为 ip:8080,也可在实例列表->更多操作->配置开放端口 处看到对应8080端口的链接。

Open WebUI的账号密码:

首次对话回复时间较长,耐心等待

苍耳阿猫认证作者
个人主页
0 个镜像 · 被使用 1
版本日志
v1.0最新
08-27
vllm-qwen3.8-27b
评分
0.0
暂无评分
我的评分
未评分
vllm-qwen3.8-27b一键部署 | 优云智算