优云智算
控制台
立即注册

LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析

LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析

镜像大小
110 GB
当前版本
v1.0
累计部署
15
累计运行
0 h
最近更新
2026-02-02

运行环境

框架版本
PyTorch-12.8
CUDA版本
12.8
应用
JupyterLab: 8888
支持卡型
RTX40系RTX50系
+6

LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,流式推理,支持PDF全量解析

镜像简介

本镜像搭载高效的1B参数视觉语言模型LightOn-OCR-1B,专注于复杂图片与PDF文档的文字信息提取,可精准处理图文混排版面,并支持实时生成结构清晰的MarkDown文档。结合目标检测与视觉场景识别技术,它能够理解并解析文档的视觉元素与逻辑关系,适用于文档数字化、知识库构建、资料高效归档及自动化内容整理等场景。

镜像使用指南

1、使用该镜像创建实例,该镜像支持自启动,初始化后,需要等待服务启动,大概2分钟左右,可以输入命令 tail -50f /root/wan/log.txt 查看启动日志 image.png image.png 2、随后点击 SD-WEBUI 按钮即可,上传图片或者PDF文档,点击解析按钮即可

PixPin_2026-02-01_09-29-42.png

3 也支持全量PDF文档解析,直接下载结果,不限制页数

刘悦的技术博客认证作者
个人主页
0 个镜像 · 被使用 15
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
02-01
评分
0.0
暂无评分
我的评分
未评分
LightOn-OCR-1B,图片和PDF文字提取,图文混排,实时生成MarkDown文档,MarkDown文档下载,支持PDF全量解析一键部署 | 优云智算