
Infinity-Parser2:全新 SOTA 多模態文件解析模型
Infinity-Parser2 是一款全新的多模態模型,具備 500 萬樣本的合成語料庫與多任務強化學習框架。該模型在文件解析基準測試中達到頂尖水準,超越了 DeepSeek-OCR-2 等模型。
Tag: #document-parsing5 results

Infinity-Parser2 是一款全新的多模態模型,具備 500 萬樣本的合成語料庫與多任務強化學習框架。該模型在文件解析基準測試中達到頂尖水準,超越了 DeepSeek-OCR-2 等模型。
百度開源了專為長文檔解析設計的 Unlimited OCR 模型(3B 參數)。憑藉其高效率與準確性,該模型已登頂多個 GitHub 與 HuggingFace 熱門榜單。

百度在 ModelScope 上發布了 Unlimited-OCR,這是一款 3.3B 參數的模型,專為圖像、多頁文件和 PDF 的單次解析而設計。它支援 32K 輸出長度,並針對全文件提取進行了優化。

PaddleOCR 3.5 已更新並支援 Transformers 後端,實現更靈活的文件解析與 OCR 工作流程。此整合讓開發者能利用 Hugging Face 生態系統進行進階文字識別任務。

高RAG準確率取決於優秀文件解析。AnythingLLM在解析能力落後RAGFlow。企業選型須考量隱藏成本。