【实战教程】EasyClick 调用 OCR 文字识别 API(自动识别屏幕文字 + 完整示例代码)

在安卓自动化领域(如任务执行、数据采集、批量操作)中,一个关键能力是:

👉 让脚本"看懂屏幕内容"

而实现这一能力的核心技术就是:

👉 OCR 文字识别 + API 接口调用

本篇文章将带你从 0 到 1 实现:

  • EasyClick 调用 OCR 接口完整流程

  • 屏幕截图 → 上传 → 识别 → 获取文字

  • 可直接参考的代码示例

  • 常见问题与优化方案


一、什么是 OCR?在 EasyClick 中有什么用?

OCR(Optical Character Recognition)可以将图片中的文字提取出来。

在 EasyClick 中的典型应用:

  • 自动识别 APP 界面文字

  • 自动判断按钮状态(如"领取""完成")

  • 自动化执行任务流程

  • 数据采集(电商/内容平台)

👉 新手建议先看基础:《文字识别通用OCR接口调用与功能说明》


二、实现原理(核心流程)

EasyClick 调用 OCR API 的标准流程:

👉 5步搞定:

1️⃣ 截图当前屏幕

2️⃣ 保存为图片文件

3️⃣ 调用 OCR API 上传图片

4️⃣ 获取 JSON 返回结果

5️⃣ 提取文字并执行逻辑


三、OCR API 接口说明

接口支持:

  • 通用文字识别

  • 多语言识别

  • 自动纠偏

  • 高精度识别

👉 支持免费在线体验,API文档清晰,附带多种语言的接口示例:https://market.shiliuai.com/general-ocr

👉 API 文档


四、EasyClick 调用 OCR 实战


1️⃣ 截图保存

复制代码
// 截图保存到本地
captureScreen("/sdcard/ocr.png");

2️⃣ 调用 OCR API

复制代码
// ===========================
// API文档:https://market.shiliuai.com/doc/advanced-general-ocr
// ===========================

function main()
    local request = image.requestScreenCapture(10000, 0)
    if not request then
        request = image.requestScreenCapture(10000, 0)
    end
    local appCode = "你的 APPCODE"
    local img = image.captureFullScreenEx()
    local res = ocr_easy(appCode, img)
    logd(res.success)
end

function ocr_easy(appCode, img)
    local url = "https://ocr-api.shiliuai.com/api/advanced_general_ocr/v1"
    local imgBase64 = image.toBase64Format(img, "jpg", 100)
    image.recycle(img)
    local body = JSON.stringify({ file_base64 = imgBase64 })
    local params = {
        url = url,
        method = "POST",
        headers = {
            ["Authorization"] = "APPCODE " .. appCode,
            ["Content-Type"] = "application/json"
        },
        requestBody = body
    }
    local res = http.request(params)
    return JSON.parse(res.body)
end

3️⃣ 输出返回结果

复制代码
log(result);

4️⃣ 解析识别文字

复制代码
var data = JSON.parse(result);

if (data.code === 200) {
    var text = data.data.text;
    log("识别内容:" + text);
}

五、完整示例(可直接参考)

复制代码
// ===========================
// EasyClick OCR 自动识别示例
// API文档:https://market.shiliuai.com/doc/advanced-general-ocr
// ===========================

function main()
    local request = image.requestScreenCapture(10000, 0)
    if not request then
        request = image.requestScreenCapture(10000, 0)
    end
    local appCode = "你的 APPCODE"
    local img = image.captureFullScreenEx()
    local res = ocr_easy(appCode, img)
    logd(res.success)
end

function ocr_easy(appCode, img)
    local url = "https://ocr-api.shiliuai.com/api/advanced_general_ocr/v1"
    local imgBase64 = image.toBase64Format(img, "jpg", 100)
    image.recycle(img)
    local body = JSON.stringify({ file_base64 = imgBase64 })
    local params = {
        url = url,
        method = "POST",
        headers = {
            ["Authorization"] = "APPCODE " .. appCode,
            ["Content-Type"] = "application/json"
        },
        requestBody = body
    }
    local res = http.request(params)
    return JSON.parse(res.body)
end

六、常见问题(避坑指南)


❌ 1. 识别不准?

原因:

  • 截图模糊

  • 图片分辨率低

  • 文字过小

👉 优化方案:
参考:《图片变清晰 API 实战》


❌ 2. 接口返回失败?

检查:

  • API地址是否正确

  • 图片是否成功上传

  • 参数格式是否正确


❌ 3. 无法解析 JSON?

👉 确保:

  • 返回格式正确

  • 使用标准 JSON.parse


七、进阶玩法(非常关键)


🚀 玩法1:OCR + 去水印

👉 自动处理图片后再识别
参考:《图片去水印 API 实战》


🚀 玩法2:OCR + 高清化

👉 提高识别准确率
参考:《图片变清晰 API》


🚀 玩法3:自动化执行系统

👉 实现:

  • 自动识别文字

  • 自动点击操作

  • 自动流程执行

👉 参考:《OCR系统集成实战》


八、总结

通过本文你已经掌握:

✅ EasyClick 调用 OCR API 完整流程

✅ 安卓自动化识别文字实现方法

✅ 可直接参考的代码示例


📚 延伸阅读


🎯 最后总结

👉 在安卓自动化领域,OCR 是实现"智能脚本"的核心能力。

👉 建议直接体验接口石榴智能文字识别API:支持免费测试,接入简单,几分钟即可跑通。

相关推荐
AIGC大时代15 分钟前
知网 AIGC 检测在罚什么:均匀句长、低指代、零口癖,并不等于「用过 ChatGPT」
人工智能·chatgpt·nlp·aigc·论文·知网·学术规范
计算机魔术师17 分钟前
Meta突然杀进第一梯队:一个新模型,把AI推理成本打下来8倍
前端
华奥系科技18 分钟前
银发经济浪潮下,智慧养老该如何落地生根
大数据·人工智能
czxxxc22 分钟前
创客匠人AI观察:模型竞赛再提速,安全与治理成新主线
人工智能·知识付费
IT_陈寒29 分钟前
Redis缓存雪崩把我坑惨了,这次长记性了
前端·人工智能·后端
百胜软件@百胜软件36 分钟前
百胜软件入选“828精选AI解决方案图谱”,胜券AI助力零售品牌构建专属智能体
大数据·人工智能·零售
风骏时光牛马40 分钟前
提示词工程:大模型效能挖掘与指令设计实战
前端
LucianaiB42 分钟前
用 WorkBuddy 研究腾讯、阿里和 DeepSeek,我没敢直接说「AI 很赚钱」
后端
仓三42 分钟前
Chrome DevTools MCP 上手:让 Coding Agent 自己调试前端页面
前端·chrome devtools·mcp
计算机魔术师1 小时前
扒完Google AI Agent挑战赛的前三名,我发现了一个共同点
前端