当你想要格式化文档输出、网页历史、API Key、积分计量和删除控制,而不想先搭云服务时,可以选择专注 OCR 的产品工作流。
适合需要可用 OCR 工作流的产品团队、运营团队和开发者。
拖拽文件到此处,或点击选择文件
支持 JPEG、PNG、GIF、WebP、BMP、TIFF、HEIC、PDF
文件大小上限:20MB
批量上传:最多 20 个文件
从剪贴板粘贴图片或图片链接
Google Vision 是通用云 API。Image to Text 更关注 OCR 专属流程:上传界面、格式化输出、保存历史、定价、API Key 和运营可见性。
可以直接从 OCR 工作区或 API Key 设置开始,而不是先配置云账号。
同一流程返回 Markdown、纯文本、分页 JSON 和结构化块。
登录用户可以查看、编辑、下载、重试和删除 OCR 结果。
管理员可以查看 OCR 任务、错误、用量模式和高成本用户。
根据你需要的是云视觉基础能力,还是 OCR 产品工作流来选择。
| 能力 | Image to Text OCR 产品 | Google Vision 云 API | 自建产品层 围绕 API 开发 |
|---|---|---|---|
| 开始使用 | |||
| 浏览器 OCR 工作区 | 自建 UI | ||
| 应用内 API Key | 云 IAM | 自建鉴权 | |
| 按 OCR 积分定价 | 云计费 | 自建计费 | |
| 文档流程 | |||
| 格式化 Markdown | 需后处理 | 自定义代码 | |
| OCR 历史和删除 | 自建存储 | ||
| OCR 运营后台 | 云日志 | 自建看板 | |
输出设计目标是可以直接进入复核、导出或 API 集成。
## 服务协议 | 生效日期:2026-06-13 | 主体:客户和服务商
| 项目 | 数量 | 金额 | 行数据可继续用于表格导出。
响应包含 success、text、markdown、pages、elapsed_ms 和 usage.credits。
如何评估二者差异。