OCR 是什么,什么时候应该使用?

2026/06/13

OCR 是 Optical Character Recognition,也就是光学字符识别。放到产品工作流里,它的作用是把扫描图片、截图或 PDF 页面转成可搜索、可复制、可存储、可继续处理的文本。

如果文件主要是文字,可以从 Image to Text 开始。如果你需要保留标题、列表、表格或公式,应该使用 PDF to Markdown

Simple OCR 和 Formatted OCR 的区别

Simple OCR 适合只要纯文本的场景:

Invoice No: INV-2026-018
Total: $428.90
Due Date: 2026-07-15

Formatted OCR 适合需要保留结构的文档:

## Invoice INV-2026-018

| Item           | Qty |  Amount |
| -------------- | --: | ------: |
| OCR processing |   1 | $428.90 |

常见输入

OCR 适用于照片、截图、扫描 PDF、收据、发票、名片和手写笔记。更具体的场景可以直接使用 Screenshot to TextInvoice OCRHandwriting to Text

上传前检查什么

源文件越清晰,识别结果越稳定。尽量裁掉无关边框,保持文字方向正确,只在需要版面结构时选择 Formatted OCR。表格文档可以使用 Table OCRPDF to Excel

下一步

你可以直接打开 Image to Text 试用,查看 Pricing 理解积分规则,或使用 OCR API 做自动化集成。

Image to Text Team

Image to Text Team

OCR 是什么,什么时候应该使用? | 博客