Jina AI 发布文档解析模型 jina-ocr-v1,可将 PDF、扫描件、表格和图表直接转换为 Markdown。
模型架构与训练方式
根据 Jina AI 介绍,jina-ocr-v1 基于 DeepSeek-OCR 做后训练,沿用其约 34 亿总参数、解码时每个 Token 激活约 5.7 亿参数的 MoE 架构,并加入 FastMTP 推测解码。
基准测试结果
在 Jina 自测中,jina-ocr-v1 在 OmniDocBench v1.6 上得分为 91.14,比 DeepSeek-OCR-2 高 0.89 分;在 olmOCR-Bench 上得分为 83.4,比其实际基于的 DeepSeek-OCR 底模高 7.4 分。
页面吞吐表现
吞吐量是 Jina 主打的卖点之一。按其公布的数据,在单张 A100、并发 32 的条件下,jina-ocr-v1 达到 2.57 页/秒,在 Jina 测试的 14 个系统中排名第一,比 DeepSeek-OCR 的 2.10 页/秒高约 22%。
模型发布方式
Jina 表示,模型权重已经上传至 Hugging Face,采用 CC BY-NC 4.0 许可,商业使用需要联系 Jina。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

