优云智算
控制台
立即注册

xinference_GPU

Xorbits Inference (Xinference) 是一个开源平台,用于简化各种AI 模型的运行和集成。 借助Xinference,可以使用任何开源LLM、Embedding模型和Rerank模型在云端或本地环境中运行推理

镜像大小
60 GB
当前版本
v1.0
累计部署
42
累计运行
281 h
最近更新
2025-07-14

运行环境

框架版本
PyTorch-2.1.0
CUDA版本
12.4
应用
JupyterLab: 8888
支持卡型
RTX40系2080
+11

Xinference 镜像使用教程

Xinference 项目介绍

Xorbits Inference (Xinference) 是一个开源平台,用于简化各种AI 模型的运行和集成。 借助Xinference,可以使用任何开源LLM、Embedding模型和Rerank模型在云端或本地环境中运行推理。

镜像快速部署教程

1. 在镜像详情界面,点击“使用该镜像创建实例”

image

2. 先选择GPU型号(以RTX40系为例,也可选择镜像支持的其它型号),再点击“立即部署”

image

3. 待实例初始化完成后,在控制台-应用中点击“JupyterLab”

image

4. 进入JupyterLab后,新建终端Terminal,输入以下指令

xinference-local --host 0.0.0.0 --port 8890

当运行出现以下结果时,即可在浏览器中通过 ip:8890 进入web界面

image

ip可以在控制台-基础网络(外)通过复制得到

image

进入web界面后如下图所示即启动成功

image

0 个镜像 · 被使用 42
版本日志
v1.0最新
2025-02-25
Xinference 框架
评分
0.0
暂无评分
我的评分
未评分
xinference_GPU一键部署 | 优云智算