Baidu hat „Unlimited OCR“ als Open-Source-Projekt veröffentlicht, ein End-to-End-Modell mit 3 Milliarden Parametern für die Analyse langer Dokumente. Es nutzt etwa 570 Millionen Parameter und verfügt über „Reference Sliding Window Attention“ für die kontinuierliche Analyse mehrseitiger Dokumente mit konstantem KV-Cache. Es erzielte 93,92 % auf OmniDocBench v1.6 und ist 12,7–35 % schneller als DeepSeek OCR; innerhalb von 5 Tagen erreichte es 10.000 GitHub-Stars.





Heim
