OCR 文字识别

上传图片或 PDF,使用 AI 驱动的 OCR 提取文字。支持 111+ 种语言,输出结构化 Markdown 格式。

准备就绪

拖拽文件到此处,或点击选择文件

支持 JPEG、PNG、GIF、WebP、BMP、TIFF、HEIC、PDF
文件大小上限:20MB
批量上传:最多 20 个文件

从剪贴板粘贴图片或图片链接

图片链接
上传敏感文件前,可先查看 OCR 上传、历史、API 日志和删除规则。 隐私和安全

如何使用

我们的 OCR 工具使用 PaddleOCR-VL 分析您的图片和 PDF,检测文字区域并高精度提取内容。支持 111+ 种语言,输出结构化 Markdown 格式。

使用步骤

  1. 1

    上传文件

    将图片或 PDF 拖放到上传区域,点击从设备中选择文件,或粘贴图片 URL。支持 JPEG、PNG、GIF、WebP、BMP、TIFF 和 PDF,最大 20MB。

  2. 2

    选择识别模式

    选择简单 OCR 提取纯文本(1 积分/页),或格式化 OCR 输出保留表格、标题和公式的 Markdown 结构(10 积分/页)。

  3. 3

    开始识别

    点击开始,AI 将处理您的文件。小图片几秒内完成;大 PDF 将异步处理并实时更新状态。

  4. 4

    查看和导出

    以 Markdown 格式查看提取的文字。复制到剪贴板或下载结果。OCR 历史记录保留您的识别结果,方便后续查阅。

支持的输入格式

常见问题

OCR 支持哪些语言?
我们的 OCR 工具支持 111+ 种语言,包括中文、英语、日语、韩语、阿拉伯语、俄语以及大多数欧洲和亚洲语言。系统会自动检测文档中的语言。
最大文件大小是多少?
最大文件大小为 20MB。支持的格式包括 JPEG、PNG、GIF、WebP、BMP、TIFF 和 PDF。
简单模式和格式化模式有什么区别?
简单模式提取不含格式的纯文本。格式化模式以 Markdown 格式保留文档结构,包括标题、表格、列表和代码块。
OCR 的准确率如何?
准确率取决于图片质量、文字清晰度和语言。清晰、光线良好的标准字体图片通常能达到 95% 以上的准确率。手写文字和低分辨率图片的准确率可能较低。
我的数据会保密吗?
通过网页工具上传的文件在处理后会被删除。API 用户的文件被视为临时文件——仅保留处理请求所需的时间。请查看我们的隐私控制以了解数据删除选项。
OCR 需要多少积分?
每次 OCR 请求根据模式和页数消耗积分。格式化模式比简单模式消耗更多。注册用户优先访问;访客用户有每日使用限制。

更多工具

OCR 文字识别 - 从图片和PDF中提取文字