文字识别技术 · 同步接口
OCR图片识别API接入指南
OCR图片识别API面向需要把图片文字变成结构化文本的开发场景:上传图片或传入图片URL,接口同步返回完整识别文本(full_text),并为每个文本块给出置信度与四点坐标,方便二次校对、表格还原和自动录入。单次调用约0.03元,按量计费无需套餐。
接口速览
以下信息来自轻语API开放平台生产环境接口元数据,可直接用于技术选型评估。
| 接口地址 | POST /data/api/ocrRecognize |
|---|---|
| 计费 | 约0.03元/次 |
| 频率限制 | 60次/分钟 |
| 超时时间 | 60秒 |
| 鉴权方式 | apikey(注册后获取) |
| 内容类型 | multipart/form-data 或 application/x-www-form-urlencoded |
请求参数
| 参数名 | 必填 | 类型 | 说明 |
|---|---|---|---|
apikey | 必填 | string | 用户的apikey,身份凭证,注册后在控制台获取 |
file | 选填 | file | 图片文件实体,与url二选一;支持png/jpg/jpeg/bmp等常见格式 |
url | 选填 | string | 图片的网络URL链接,与file二选一;适合已托管在云端的图片 |
响应示例
成功响应(HTTP 200)
{
"code": 200,
"message": "success",
"total": 3,
"elapsed": 4.23,
"data": {
"full_text": "完整识别文本内容",
"items": [
{
"index": 1,
"text": "识别出的单行文本",
"confidence": 98.6,
"position": [[12, 30], [220, 30], [220, 58], [12, 58]]
}
]
}
}
调用示例
cURL 示例
curl -X POST 'https://5555api.com/data/api/ocrRecognize' \
-F 'apikey=YOUR_APIKEY' \
-F 'file=@invoice.png'
JavaScript 示例
const fd = new FormData();
fd.append('apikey', 'YOUR_APIKEY');
fd.append('file', fileInput.files[0]); // 或改用 url 字段传入图片链接
const resp = await fetch('https://5555api.com/data/api/ocrRecognize', {
method: 'POST',
body: fd
});
const result = await resp.json();
if (result.code === 200) {
console.log('识别全文:', result.data.data.full_text);
result.data.data.items.forEach(item => {
console.log(item.text, '置信度:', item.confidence);
});
}
Python 示例
import requests
resp = requests.post(
'https://5555api.com/data/api/ocrRecognize',
data={'apikey': 'YOUR_APIKEY'},
files={'file': open('invoice.png', 'rb')}
)
result = resp.json()
if result['code'] == 200:
data = result['data']['data']
print('全文:', data['full_text'])
for item in data['items']:
print(item['text'], item['confidence'])
应用场景
票据与发票录入
拍照或扫描的发票、收据直接转文本,配合items坐标定位金额与日期字段,自动录入财务系统。
截图内容提取
聊天记录、网页截图、错误弹窗中的文字一键提取,用于工单归档与自动化测试断言。
档案与纸质文档数字化
合同、档案扫描件批量识别,置信度低于阈值的行进入人工复核队列,降低录入成本。
常见问题
OCR图片识别API怎么调用?
向 https://5555api.com/data/api/ocrRecognize 发送POST请求,携带apikey和file(本地图片)或url(图片链接)任一参数即可,接口同步返回识别结果。单次调用约0.03元。
支持哪些图片格式,图片有大小限制吗?
支持png、jpg、jpeg、bmp等常见图片格式。建议单张图片不超过10MB;过大图片可先压缩再上传,识别效果更稳定。
file和url参数可以同时传吗?
两个参数二选一即可。同时传入时以file为准。服务端图片建议用url,本地图片建议用file直传。
识别结果里的confidence和position有什么用?
confidence是0-100的置信度,可用于筛选低质量识别行;position是文本块的四点坐标,可用于原文比对、表格还原和关键字段定位。
识别中文准确率怎么样,支持手写体吗?
印刷体中文识别准确率高,中英文混排均可识别;工整手写体可以识别,潦草手写体建议人工校对,可用confidence字段过滤。
怎么获取apikey,调用失败提示什么错误?
注册轻语API账号后在控制台获取apikey。常见错误:apikey缺失或错误、file与url都未传、图片下载失败、账户余额不足。