提交文件、图片 URL 或 Base64,并获得规范化 OCR 文本、Markdown、分页块和 Processing Credit 用量。
接口:POST /api/v1/ocr
该页面总结开发者流程:创建 Developer API Key、提交 OCR 输入、接收规范化输出、监控用量,并通过 Processing Credits 保持成本可预测。
从后端提交 multipart 文件、image_url 或 Base64。
返回 success、text、markdown、pages、elapsed_ms 和 usage.credits。
识别前检查 Processing Credits,成功识别后再扣除。
有效 Key 请求会记录状态、耗时、Processing Credits、来源类型、IP 和 User-Agent。
根据集成深度选择合适的工作流。
| 能力 | OCR API 自动化 | 网页 OCR 人工复核 | 自建 OCR 服务 自行开发和运维 |
|---|---|---|---|
| 集成 | |||
| 服务端调用 | |||
| Developer API Key 鉴权 | 自建 | ||
| 文件、URL、Base64 输入 | 文件和 URL | 自定义 | |
| 运营 | |||
| 调用日志 | 历史记录 | 自建 | |
| Processing Credit 计费 | 自建 | ||
| 错误映射 | 自建 | ||
响应结构面向产品集成设计。
success: true, data.markdown, data.text, data.pages, elapsed_ms, usage.credits
pages[0].blocks 可包含 type、text、confidence、bbox 和页元数据。
包含 401 invalid key、402 insufficient credits、429 limit exceeded 和结构化 OCR 错误。
鉴权、计费和响应行为。