Jina 魔改 DeepSeek-OCR,自测14款中页面吞吐量排名第一
2026-09-19 11:49:17
幣界網消息,Jina 發布了文檔解析模型 jina-ocr-v1,該模型能夠將 PDF、掃描件、表格和圖表直接轉換為 Markdown。它基於 deepseek-ocr 進行後訓練,使用約34億總參數,在解碼時每個 token 激活約5.7億參數的 MOE 架構,加入了 fastmtp 推測解碼。在自測中,jina-ocr-v1 在 omnidocbench v1.6 中得分91.14,比 deepseek-ocr-2 高0.89分;在 olmocr-bench 中得分83.4,比其基礎的 deepseek-ocr 底模高7.4分。吞吐量是 Jina 的主要賣點之一,單張 A100、並發32時,達到2.57頁/秒,成爲 Jina 測試的14個系統中最高的,較 deepseek-ocr 的2.10頁/秒高出約22%。模型權重已上傳至 Hugging Face,採用 CC BY - NC 4.0許可,商業使用需聯繫 Jina。
利好 0
利空 0
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。