百度近日發佈並開源了3B參數規模的端到端OCR模型——
技術上,
在OmniDocBench v1.6基準測試中,該模型以93.92%的成績刷新紀錄。真實場景下,其推理速度較DeepSeek OCR提升約12.7%,在6000Tokens輸出長度下速度優勢擴大至35%,爲海量文檔數字化和大模型長程記憶管理提供了全新路徑。
百度近日發佈並開源了3B參數規模的端到端OCR模型——
技術上,
在OmniDocBench v1.6基準測試中,該模型以93.92%的成績刷新紀錄。真實場景下,其推理速度較DeepSeek OCR提升約12.7%,在6000Tokens輸出長度下速度優勢擴大至35%,爲海量文檔數字化和大模型長程記憶管理提供了全新路徑。