开发者 OCR API

提交文件、图片 URL 或 Base64,并获得规范化 OCR 文本、Markdown、分页块和 Processing Credit 用量。

接口:POST /api/v1/ocr

开发者 OCR API

从测试文件到生产 OCR 的开发路径

该页面总结开发者流程:创建 Developer API Key、提交 OCR 输入、接收规范化输出、监控用量,并通过 Processing Credits 保持成本可预测。

多种输入

从后端提交 multipart 文件、image_url 或 Base64。

规范化响应

返回 success、text、markdown、pages、elapsed_ms 和 usage.credits。

Processing Credit 计量

识别前检查 Processing Credits,成功识别后再扣除。

调用日志

有效 Key 请求会记录状态、耗时、Processing Credits、来源类型、IP 和 User-Agent。

开发者 OCR 选项

根据集成深度选择合适的工作流。

能力
OCR API
自动化
网页 OCR
人工复核
自建 OCR 服务
自行开发和运维
集成
服务端调用
Developer API Key 鉴权自建
文件、URL、Base64 输入文件和 URL自定义
运营
调用日志历史记录自建
Processing Credit 计费自建
错误映射自建

API 响应示例

响应结构面向产品集成设计。

成功响应

success: true, data.markdown, data.text, data.pages, elapsed_ms, usage.credits

分页块

pages[0].blocks 可包含 type、text、confidence、bbox 和页元数据。

错误

包含 401 invalid key、402 insufficient credits、429 limit exceeded 和结构化 OCR 错误。

开发者 OCR API FAQ

鉴权、计费和响应行为。




开始接入 OCR API

创建 Key,发送测试请求,并在集成扩展时监控用量。

开发者 OCR API | Image to Text