讀紙 ReadPaper

由 Claude Code Max 翻譯的 AI 論文繁體中文版 · 101 篇

篩選標籤: OCR 3 篇 × 清除
2609.03181v1 CC BY-NC-SA 4.0 Alibaba / Qwen Team

Jina-OCR-v1:以推測式解碼與稠密可驗證獎勵做高效文件解析

Jina-OCR-v1: Efficient Document Parsing with Speculative Decoding and Dense Verifiable Rewards

Alejandro Barón García, Feng Wang, Emilia Garcia Casademont, Han Xiao

OCR文件解析推測式解碼MTPGRPORLVRMoE
鄭子凡 許願
2604.04771v2 arXiv License Alibaba / Qwen Team

MinerU2.5-Pro:推動資料中心文件解析的規模極限

MinerU2.5-Pro Pushing the Limits of Data-Centric Document Parsing at Scale

Bin Wang, Tianyao He, Linke Ouyang, Fan Wu, Zhiyuan Zhao, et al.(上海 AI Lab、北京大學、上海交大、商湯科技)

Document ParsingVLMOCRData-Centric AIBenchmark文件解析
鄭子凡 許願
2512.02498v4 arXiv License MIT

dots.ocr:用單一視覺語言模型完成多語文件版面解析

dots.ocr Multilingual Document Layout Parsing in a Single Vision-Language Model

Yumeng Li, Guang Yang, Hao Liu, Bowen Wang, Colin Zhang (hi lab, Xiaohongshu Inc / 小紅書)

VLMOCRDocument ParsingMultilingualLayout DetectionXiaohongshu開源模型OmniDocBench
鄭子凡 許願