OCR文字识别API最小可运行示例:参数、请求与字段全解
适用场景通用OCR文字识别接口可用于从图片中提取任意文字涵盖中文、英文、数字、符号及手写体。典型场景包括截图转文本将屏幕截图发送给API返回可编辑的文本行。名片/身份证录入识别卡片上的字段并结构化存储。字幕提取从视频帧中提取字幕字符串。笔记OCR将手写笔记拍照后转为电子文本。若需处理专用票据如发票请使用对应专用接口如/api/invoice通用接口对于非标准排版同样有效。接口能力边界在开始编写代码前需要了解该接口的几个关键限制维度说明QPS2次/秒超过会返回限流错误图片输入方式URL公网可访问或 base64最大6MB缓存相同图片内容在1小时内返回缓存结果不重复消耗配额鉴权可选 Authorization头Bearer sk_live_xxx匿名调用每日5次返回值逐行文本列表 完整拼接文本 行数缓存机制对开发调试非常友好重复发送同一图片只会消耗一次上游配额适合批量重试场景。鉴权与请求头身份验证接口支持两种模式匿名调用无需任何鉴权头每日5次调用次数限制适合快速原型验证。认证调用在请求头中添加Authorization: Bearer sk_live_xxxxxxxxxxxxxx获得更高配额。注意事实卡中 curl 示例使用了X-API-Key头但官方最新文档推荐使用Authorization: Bearer格式。以下示例采用标准 Bearer 方案两种方式均可工作请以官方文档为准。Content-Type虽然文档中有时出现application/x-www-form-urlencoded但实际可运行的生产请求多采用 JSON 格式。本示例使用application/json这是业界通用的做法。请求参数详解接口使用 POST 方法请求地址固定为https://v1.apizero.cn/api/ocr-text。请求体是一个 JSON 对象包含两个必填字段input_type类型string必填是可选值url或base64含义指定input_data的格式。url表示传入一张公网可访问的图片链接http/httpsbase64表示传入图片的 base64 编码字符串。input_data类型string必填是当input_typeurl时传入完整的图片 URL例如https://example.com/image.png。当input_typebase64时传入 base64 编码后的字符串最大6MB。支持data:image/jpeg;base64,前缀API 会自动剥离。如果自己拼接建议去除前缀以节省体积。最小可运行示例curl 匿名调用以下是一条无需任何鉴权、可直接运行的 curl 命令使用了一张虚拟测试图片包含文字“Hello World”curl -sS -X POST \ -H Content-Type: application/json \ -d {input_type:url,input_data:https://dummyimage.com/400x100/000/fff.pngtextHelloWorld} \ https://v1.apizero.cn/api/ocr-text执行结果示例{ code: 0, data: { full_text: Hello World, input_type: url, text_count: 1, text_list: [Hello World] }, msg: 成功, request_id: abc123def456 }注意dummyimage.com生成的图片可能包含随机文字实际返回内容可能与示例不同但结构一致。使用认证调用Bearer Token将sk_live_xxxxxxxxxxxxxx替换为真实的密钥curl -sS -X POST \ -H Authorization: Bearer sk_live_xxxxxxxxxxxxxx \ -H Content-Type: application/json \ -d {input_type:url,input_data:https://example.com/screenshot.png} \ https://v1.apizero.cn/api/ocr-textbase64 输入示例假设图片已经转换为 base64 字符串存储为变量IMG_B64直接传入IMG_B64$(base64 -w0 /path/to/image.png) curl -sS -X POST \ -H Content-Type: application/json \ -d {\input_type\:\base64\,\input_data\:\$IMG_B64\} \ https://v1.apizero.cn/api/ocr-text代码接入Python 示例使用requests库适配 python3import requests import json API_URL https://v1.apizero.cn/api/ocr-text def ocr_image(image_url: str, api_key: str ) - dict: 调用 OCR 接口返回 JSON 响应。 :param image_url: 图片公网 URL :param api_key: Bearer token匿名时传空字符串 :return: 响应 dict headers {Content-Type: application/json} if api_key: headers[Authorization] fBearer {api_key} payload { input_type: url, input_data: image_url } resp requests.post(API_URL, headersheaders, jsonpayload) resp.raise_for_status() return resp.json() # 最小示例匿名调用 if __name__ __main__: test_url https://dummyimage.com/400x100/000/fff.pngtextHelloWorld result ocr_image(test_url) print(json.dumps(result, indent2, ensure_asciiFalse))运行后输出结构如前所示。若需处理本地图片可先用 base64 编码import base64 with open(local_image.png, rb) as f: b64_data base64.b64encode(f.read()).decode(utf-8) payload { input_type: base64, input_data: b64_data }响应字段解读成功响应的 JSON 结构如下字段类型说明codeint0 表示成功非 0 表示错误msgstring状态描述信息request_idstring本次请求的唯一标识可用于问题排查data.input_typestring回显请求中的输入类型data.text_listarray[string]按图片原始顺序排列的文本行列表data.full_textstring所有文本行以\n拼接后的完整字符串data.text_countint识别到的文本行数典型错误响应{ code: 1001, msg: 参数错误input_type 只能为 url 或 base64, request_id: req-xxx }常见错误码及含义code含义排查方向1001参数非法检查 input_type、input_data 是否缺失或格式不对1002图片无法访问 / base64解码失败对于 url确认链接可公网下载对于 base64检查原始数据是否完整1003图片过大超过6MB压缩图片或减少 base64 数据长度1004请求频率超限降低请求速度间隔至少 500ms1005认证失败检查 Authorization 头格式或密钥有效性9999内部错误联系技术支持或稍后重试工程化注意事项1. 缓存机制利用同图在1小时内重复调用会直接命中缓存text_list、full_text均相同。因此无需自己缓存结果只需保证短时间内不发送不同图片即可。但对于高频场景建议在应用层也做一次 MD5 去重减少网络开销。2. QPS 控制接口限制 2 次/秒单次请求耗时约 200-800ms。若需批量处理应使用令牌桶或简单的time.sleep(0.5)控制速率。例如import time for url in image_urls: time.sleep(0.6) # 保证低于 2 QPS resp ocr_image(url)3. 图片预处理对于真实场景图片质量直接影响识别率。建议将图片转为 PNG 或 JPEG分辨率不低于 300x100文字清晰、无倾斜。若使用 base64注意去掉data:image/...;base64,前缀API 会自动处理但建议清理以减少传输量。图片体积过大时可先用PIL或opencv缩小尺寸同时控制边长不超过 4096 像素。4. 错误重试策略对于网络超时、服务器错误code9999等可重试的暂时性错误建议重试 2~3 次间隔指数退避1s, 2s, 4s。对于参数错误code1001、认证错误1005不应重试应直接修复请求。5. 安全事项不要在客户端代码中硬编码 API Key。推荐使用环境变量或云密钥管理服务。若使用匿名调用注意每日限额 5 次生产环境必须携带认证。图片中的敏感信息如身份证号、密码请谨慎处理建议在传输前进行脱敏或授权验证。6. 测试技巧使用dummyimage.com生成带文字的测试图片https://dummyimage.com/400x100/000/fff.pngtext测试。注意某些域名可能被墙可换成via.placeholder.com。对于 base64 测试可直接用在线图片转 base64 工具生成或使用 Python 脚本。参考文档官方文档页含完整参数说明https://apizero.cn/aidocs/ocr-text原始 Markdown 文档https://apizero.cn/aidocs/ocr-text/raw.md以上内容覆盖了从认知接口到生产集成的完整链路核心要点是“最小可运行”——只需一条 curl 命令即可获得识别结果。建议读者在真实项目中先使用匿名调用验证图片是否符合预期再切换认证模式进行正式部署。

相关新闻

MagicCFG Reloaded:革命性iOS设备SysCFG编辑工具的技术突破

MagicCFG Reloaded:革命性iOS设备SysCFG编辑工具的技术突破

MagicCFG Reloaded:革命性iOS设备SysCFG编辑工具的技术突破 【免费下载链接】MagicCFG-Reloaded-OSV A fully fledged syscfg editor. Just the editor. Written in pure swift. 项目地址: https://gitcode.com/gh_mirrors/ma/MagicCFG-Reloaded-OSV 在iOS设…

2026/7/29 15:42:29 阅读更多 →
如何在5分钟内为Microsoft Word安装免费的APA第七版引用样式

如何在5分钟内为Microsoft Word安装免费的APA第七版引用样式

如何在5分钟内为Microsoft Word安装免费的APA第七版引用样式 【免费下载链接】APA-7th-Edition Microsoft Word XSD for generating APA 7th edition references 项目地址: https://gitcode.com/gh_mirrors/ap/APA-7th-Edition 如果你正在为学术论文的参考文献格式而烦恼…

2026/7/29 15:42:29 阅读更多 →
XLeRobot终极指南:如何用660美元打造你的家庭机器人并实现强化学习训练

XLeRobot终极指南:如何用660美元打造你的家庭机器人并实现强化学习训练

XLeRobot终极指南:如何用660美元打造你的家庭机器人并实现强化学习训练 【免费下载链接】XLeRobot XLeRobot: Practical Dual-Arm Mobile Home Robot for $660 项目地址: https://gitcode.com/GitHub_Trending/xl/XLeRobot 想象一下,你只需要花费…

2026/7/29 15:42:29 阅读更多 →

最新新闻

GetQzonehistory完整教程:一键备份QQ空间所有历史数据

GetQzonehistory完整教程:一键备份QQ空间所有历史数据

GetQzonehistory完整教程:一键备份QQ空间所有历史数据 【免费下载链接】GetQzonehistory 获取QQ空间发布的历史说说 项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory 想要完整保存QQ空间里的珍贵回忆吗?GetQzonehistory是一个…

2026/7/29 15:49:41 阅读更多 →
3D格式转换之IGS 转 CATIA 标准化转换技术

3D格式转换之IGS 转 CATIA 标准化转换技术

1. 文档概述 本文档面向机械结构工程师、工业设计人员、工科实训学生,系统讲解 IGS(IGES通用中性曲面格式) 转换为 CATIA(CATPart/CATProduct/CGR) 的格式特性、底层转换原理、标准化操作流程与常见故障解决方案。IGS…

2026/7/29 15:49:41 阅读更多 →
怪物猎人世界数据覆盖插件实战手册:5分钟成为高效猎人

怪物猎人世界数据覆盖插件实战手册:5分钟成为高效猎人

怪物猎人世界数据覆盖插件实战手册:5分钟成为高效猎人 【免费下载链接】HunterPie-legacy A complete, modern and clean overlay with Discord Rich Presence integration for Monster Hunter: World. 项目地址: https://gitcode.com/gh_mirrors/hu/HunterPie-le…

2026/7/29 15:49:41 阅读更多 →
明日方舟桌宠Ark-Pets:让二次元伙伴突破屏幕限制的终极指南

明日方舟桌宠Ark-Pets:让二次元伙伴突破屏幕限制的终极指南

明日方舟桌宠Ark-Pets:让二次元伙伴突破屏幕限制的终极指南 【免费下载链接】Ark-Pets Arknights Desktop Pets | 明日方舟桌宠 (ArkPets) 项目地址: https://gitcode.com/gh_mirrors/ar/Ark-Pets 想要让你最爱的明日方舟干员走出游戏世界,成为陪…

2026/7/29 15:49:41 阅读更多 →
Pixelle-Video:零基础也能轻松制作专业级AI短视频

Pixelle-Video:零基础也能轻松制作专业级AI短视频

Pixelle-Video:零基础也能轻松制作专业级AI短视频 【免费下载链接】Pixelle-Video 🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine 项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video 你是否曾经有过这样的困惑…

2026/7/29 15:49:39 阅读更多 →
3种方式批量下载小红书无水印内容:XHS-Downloader完全指南

3种方式批量下载小红书无水印内容:XHS-Downloader完全指南

3种方式批量下载小红书无水印内容:XHS-Downloader完全指南 【免费下载链接】XHS-Downloader 小红书(XiaoHongShu、RedNote)链接提取/作品采集工具:提取账号发布、收藏、点赞、专辑作品链接;提取搜索结果作品、用户链接…

2026/7/29 15:48:39 阅读更多 →

日新闻

【RT-DETR多模态创新改进】CVPR 2025 | 独家特征融合创新改进篇 | 引入RLAB残差线性注意力模块,有效融合并强调多尺度特征,多种改进点,适合红外与可见光融合目标检测任务,有效涨点

【RT-DETR多模态创新改进】CVPR 2025 | 独家特征融合创新改进篇 | 引入RLAB残差线性注意力模块,有效融合并强调多尺度特征,多种改进点,适合红外与可见光融合目标检测任务,有效涨点

一、本文介绍 🔥本文在RT-DETR多模态融合目标检测中引入RLAB残差线性注意力模块,可在不同模态特征交互阶段进行多次残差细化,使可见光、红外等特征在尺度、语义和空间位置上更好对齐;随后将细化特征与解码器输出拼接并生成Q、K、V,通过线性注意力自适应强化关键通道、目…

2026/7/29 0:00:23 阅读更多 →
AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础

AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础

AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础 在上一期「AI编程系列」中,我们学习了如何构建一个基础的 AI 问答系统,通过简单的输入输出让模型回应问题。但现实世界中的 AI 应用往往需要处理更复杂的场景:…

2026/7/29 0:00:23 阅读更多 →
AI智能体开发实战:从工具调用到企业级部署

AI智能体开发实战:从工具调用到企业级部署

1. 从被动问答到主动执行:AI Agent的范式转变过去两年,大语言模型最显著的应用形态是聊天机器人——用户提问,AI回答。但真正的生产力革命发生在2023年下半年:当AI学会主动调用工具完成任务时,生产力工具的历史被彻底改…

2026/7/29 0:00:23 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/28 12:04:22 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/29 15:00:03 阅读更多 →

月新闻