优云智算
控制台
立即注册
0.1元/时

GRPO_qwen2.5_1.5B

通过该镜像可以实现qwen2.5-1.5B的强化学习训练

镜像大小
40 GB
当前版本
v1.0
累计部署
4
累计运行
6 h
最近更新
2026-05-08

运行环境

框架版本
PyTorch-2.6
CUDA版本
12.4
应用
JupyterLab: 8888
支持卡型
A80048G RTX40系
+1

实现qwen2.5-1.5B的推理

  • 功能: 这个镜像主要用于qwen2.5-1.5B的推理
  • 特点: 预装了强化学习训练的环境,可以使用该环境进行强化学习代码的实战

环境与依赖

本镜像构建和运行所需的基础环境。

  • 框架及版本: (例如:PyTorch 2.6)
  • CUDA版本: (例如:CUDA 12.4)
  • 其他依赖: (例如:Python 3.10, GCC 7.5)

配置方法

通过jupyter页面,选择py310后,直接运行qwen2.5-1.5b.ipynb即可

环境验证代码

通过jupyter页面,选择py310后,直接运行qwen2.5-1.5b.ipynb即可

常见问题

此镜像为 王道计算机教育(B站有70多万粉丝)王道训练营的AI课程的授课镜像之一,对于王道训练营的AI课程感兴趣的同学,可以加微信 cskaoyanbb1了解,也可以直接到B站,或者王道在线 微信公众号,直接联系对应客服了解课程。

0 个镜像 · 被使用 4
版本日志
v1.0最新
2026-05-08
实现qwen2.5-1.5B的推理
评分
0.0
暂无评分
我的评分
未评分