简介
什么是 Image to Text?
Image to Text 是一个 AI 驱动的文字识别工具,能从图片和文档中高精度提取文字。基于 PaddleOCR-VL 构建,支持 111+ 种语言,输出结构化数据。
核心功能
- 多语言 OCR: 支持中文、英文、日文、韩文、阿拉伯文等 111 种以上语言
- 文档智能解析: 将复杂 PDF 和文档转换为结构化的 Markdown 和 JSON
- 视觉语言模型: PaddleOCR-VL 1.5 使用紧凑的 0.9B 参数模型,快速准确地完成文字识别
- 真实场景适用: 处理倾斜、变形、扫描及弱光图片
文档目录
- 快速开始 - 创建 API 密钥并发起首次 OCR 请求
- OCR 集成指南 - 将 OCR 集成到应用的实用模式
- OCR API 参考 - 端点参数、响应结构和示例
- 图片处理 API - 图片转换和压缩开发者指南