jina-ocr-v1:在低成本 GPU 上实现更快速的文档解析作者:来自 Elastic https://jina.ai/reader一个 34 亿参数的混合专家文档解析器,每个 token 仅激活 5.7 亿个参数。它读取页面图像,并通过单次处理返回包含文本、公式、表格和阅读顺序的 Markdown。jina-ocr-v1 是一个拥有 34 亿参数、每次激活 5.7 亿参数的视觉语言模型,在 OmniDocBench v1.6 上得分 91.1,在 olmOCR-Bench 上得分 83.4。