OCR AI

PDF Extractor

OCR

dots.ocr

是一款強大的多語言文件解析器,能在單一視覺語言模型中整合版面檢測與內容識別功能,同時維持良好的閱讀順序。儘管其基礎模型僅採用精簡的 1.7B參數大型語言模型架構,仍能達到頂尖技術水準(SOTA)的表現。 

DeepSeek-OCR

只有3B參數,採用「光學上下文壓縮」技術,將文字視為圖像,利用視覺token進行壓縮和理解,把長文字轉換成圖像進行處理,極大地降低了計算資源消耗。

olmOCR

支持結構化精准提取復雜PDF文件內容!完美識別中英文文檔、模糊掃描件與復雜表格!本地部署與實際測試全過程!醫療法律行業必備!輕松應對企業級PDF批量轉換需求

Paddle OCR

百度的開源文件解析模型 PaddleOCR-VL-1.5


Revision #8
Created 2026-07-20 11:07:29 CST by A-Lang (Admin)
Updated 2026-07-20 11:18:04 CST by A-Lang (Admin)