简介

什么是 Image to Text?

Image to Text 是一个 AI 驱动的文字识别工具,能从图片和文档中高精度提取文字。基于 PaddleOCR-VL 构建,支持 111+ 种语言,输出结构化数据。

核心功能

  • 多语言 OCR: 支持中文、英文、日文、韩文、阿拉伯文等 111 种以上语言
  • 文档智能解析: 将复杂 PDF 和文档转换为结构化的 Markdown 和 JSON
  • 视觉语言模型: PaddleOCR-VL 1.5 使用紧凑的 0.9B 参数模型,快速准确地完成文字识别
  • 真实场景适用: 处理倾斜、变形、扫描及弱光图片

文档目录