OCR C++ Tesseract从OpenCV中获取图片

这个程序演示使用OpenCV读取图片,传递给Tesseract OCR识别图片上的文本。

输入图片:程序运行后会在CMD里打印识别结果:

和之前的程序相比,输出多了:图片的分辨率估计为304

代码:

cpp 复制代码
#include <leptonica/allheaders.h>
#include <opencv2/opencv.hpp>
#include <string>
#include <tesseract/baseapi.h>

int main(int argc, char *argv[]) {

  std::string outText, imPath = argv[1];
  cv::Mat im = cv::imread(imPath, cv::IMREAD_COLOR);
  tesseract::TessBaseAPI *api = new tesseract::TessBaseAPI();

  api->Init(NULL, "eng", tesseract::OEM_LSTM_ONLY);
  api->SetPageSegMode(tesseract::PSM_AUTO);
  api->SetImage(im.data, im.cols, im.rows, 3, im.step);
  outText = std::string(api->GetUTF8Text());
  std::cout << outText;
  api->End();
  delete api;
  return 0;
}
相关推荐
飞猫的边缘AI几秒前
边缘AI时事:从豆包手机二代和Rokid×WorkBuddy联名AI眼镜看AI智能体进终端的必然与边界
人工智能·ai智能体·rokid眼镜·workbuddy·豆包手机二代
艾醒(AiXing-w)1 分钟前
LangChain 1.0 智能体开发(三):Agent 记忆管理——从短期对话到跨会话长期记忆
数据库·人工智能·langchain
知几蜗牛2 分钟前
部署大模型别先选GPU,先回答你愿意承担多少运维
人工智能
知几蜗牛3 分钟前
AI写了80万行Rust,最值得学的却是它花十倍精力读代码
人工智能
天云数据4 分钟前
OPC保姆级指南:被优化的第四个月,我在图书馆里想好了开家公司
人工智能
知几蜗牛4 分钟前
语音AI为什么总抢话?用VAD和打断机制做对实时对话
人工智能
fellow995 分钟前
V100 的上下文极限:vLLM 卡 131K,llama.cpp 冲 230K
人工智能·自然语言处理
AgentMaster6 分钟前
数据资产化落地难题:5款数据中台系统架构对比与实施记录
大数据·人工智能·算法
AIGCmagic社区11 分钟前
LightNav-0:激发VLM空间智能,迈向通用具身导航
人工智能·具身智能·ai多模态
知几蜗牛13 分钟前
AI每次提交都查漏洞,真正的升级是把证明链放进评审
人工智能