OCR 是 Optical Character Recognition,也就是光学字符识别。放到产品工作流里,它的作用是把扫描图片、截图或 PDF 页面转成可搜索、可复制、可存储、可继续处理的文本。
如果文件主要是文字,可以从 Image to Text 开始。如果你需要保留标题、列表、表格或公式,应该使用 PDF to Markdown。
Simple OCR 和 Formatted OCR 的区别
Simple OCR 适合只要纯文本的场景:
Invoice No: INV-2026-018
Total: $428.90
Due Date: 2026-07-15Formatted OCR 适合需要保留结构的文档:
## Invoice INV-2026-018
| Item | Qty | Amount |
| -------------- | --: | ------: |
| OCR processing | 1 | $428.90 |常见输入
OCR 适用于照片、截图、扫描 PDF、收据、发票、名片和手写笔记。更具体的场景可以直接使用 Screenshot to Text、Invoice OCR 或 Handwriting to Text。
上传前检查什么
源文件越清晰,识别结果越稳定。尽量裁掉无关边框,保持文字方向正确,只在需要版面结构时选择 Formatted OCR。表格文档可以使用 Table OCR 或 PDF to Excel。
下一步
你可以直接打开 Image to Text 试用,查看 Pricing 理解积分规则,或使用 OCR API 做自动化集成。

