MixTeX - 支持CPU推理的多模态LaTeX OCR

文章目录


一、项目概览

MixTeX是一款创新的多模态LaTeX识别小程序,支持本地离线环境下的高效CPU推理。

无论是LaTeX公式、表格还是混合文本,MixTeX都能轻松识别,并支持中英文处理。



相关资源


核心特性

1、LaTeX公式识别

准确识别复杂的LaTeX数学公式,确保数学表达式准确性

2、表格识别

高效处理并识别各类表格,生成对应的LaTeX表格代码

3、混合文本识别

同时处理包含文字、公式和表格的文本,保证识别结果的完整性

4、双语支持

支持中文和英文的高精度识别,满足不同语言环境需求


技术特点

  • 本地离线推理,无需网络连接
  • 轻量级设计,程序启动文件仅约50MB
  • 高效运行,模型加载后运行极快
  • 无需GPU,仅需CPU即可运行

二、安装

bash 复制代码
cd mixtexgui
conda create -n mixtex python=3.10.14
conda activate mixtex
pip install -r requirements.txt
pyinstaller mixtex_ui.spec

三、使用说明

1、剪贴板图片识别 :按Win+V启用剪贴板功能

2、截图识别:使用Windows截图工具或键盘截图键


环境要求

推荐LaTeX配置:

latex 复制代码
\documentclass{ctexart}
\usepackage{amssymb}
\usepackage{amsmath}
\usepackage{stmaryrd}
\usepackage{color}

四、版本更新

v1.0.1 修复文件复制问题

v1.0.2 解决高色域显示器兼容问题

v1.1.2 优化花括号和表格识别

v2.1.2 支持手写文本混合公式

v2.2.3 支持黑色背景识别

v3.2.4 支持多选题OCR,优化多行公式处理


五、当前限制

  • 仅支持清晰印刷体中英文混合公式
  • 仅支持相对简单表格识别
  • 未来计划支持手写识别和多语言

伊织 xAI 2025-05-04(日)

相关推荐
云和数据.ChenGuang1 分钟前
人工智能 机器学习期末考试题
开发语言·人工智能·python·机器学习·毕业设计
我是小伍同学1 小时前
基于卷积神经网络和Pyqt5的猫狗识别小程序
人工智能·python·神经网络·qt·小程序·cnn
lllsure3 小时前
Python基础语法
开发语言·python
zhz52143 小时前
开源数字人框架 AWESOME-DIGITAL-HUMAN 技术解析与应用指南
人工智能·ai·机器人·开源·ai编程·ai数字人·智能体
winfredzhang4 小时前
使用Python 打造多格式文件预览工具 — 图、PDF、Word、Excel 一站式查看
python·pdf·word·excel·照片·查看,zip,复制
浩皓素4 小时前
Python连接云端服务器:基于Paramiko库的实践与问题剖析
python
致于数据科学家的小陈5 小时前
Go 层级菜单树转 json 处理
python·go·json·菜单树·菜单权限·children
jardonwang15 小时前
DeepInjectSQL - 基于 AI 生成对抗网络(GAN)的下一代 SQL 注入自动化漏洞猎手
python·测试工具·生成对抗网络·安全性测试
大G哥5 小时前
加速LLM大模型推理,KV缓存技术详解与PyTorch实现
人工智能·pytorch·python·深度学习·缓存