Skip to main content
全网优质资源汇总✨

TurboOCR最快的 GPU 文档解析器 — OCR · 版面 · 表格 · 公式 → Markdown,单卡 200–559 张/秒

  1. TurboOCR

    最快的 GPU 文档解析器 — OCR · 版面 · 表格 · 公式 → Markdown,单卡 200–559 张/秒。
    一个极致快速的 GPU 文档解析器 — 不止是 OCR。PP-OCRv6 检测 + 识别,外加版面分析、 表格(→ HTML)、公式(→ LaTeX)与阅读顺序 Markdown 导出,整条流水线跑在单张 GPU 的多流 CUDA/TensorRT 引擎上,完全本地(无 VLM),同时提供 HTTP 与 gRPC 接口。 整页 OCR 在单张 RTX 5090 上最高可达 559 张/秒(小票),完整结构化解析 (版面 + 表格 + 公式)约 20 页/秒 — 而 PaddleOCR-VL 这类 VLM 文档解析器约为 1 页/秒。在表单和小票上,它既准确又比传统 OCR 引擎快 15–90 倍。
    最高 559 张/秒(小票)/ 520 张/秒(表单),单张 RTX 5090,默认即最快
    表单与小票高精度 — 与 PaddleOCR-VL、PaddleOCR-Python、RapidOCR、EasyOCR、Tesseract 同台竞技(基准测试
    PP-OCRv6 — 一个模型覆盖拉丁 + 中文 + 日文;可选 tiny(默认)/ small / medium
    更多文字 — 阿拉伯文、西里尔文、韩文、泰文、希腊文(保留的 PP-OCRv5 识别器)
    原生 PDF — 页面并行渲染与识别,可选页面图片导出与自动转正
    版面 + 阅读顺序 — PP-DocLayoutV3(25 类)+ 类别感知 XY-cut,按请求开启
    表格与公式 — 按需开启:SLANet+ 表格 → HTML、PP-FormulaNet-S 公式 → LaTeX,与文本一同输出(开启方法
    一行 Docker 部署,首次启动自动构建 TensorRT 引擎,/metrics 提供 Prometheus 指标


    访问官网

    使用有技术性门槛


    #文档解析 #docker