Link:ATH-MaaS
OvisOCR2: Kompaktes 0,8B-End-to-End-Modell für Dokumenten-Parsing
ATH-MaaS hat OvisOCR2 veröffentlicht, ein kompaktes multimodales Modell mit 0,8 Milliarden Parametern zum Dokumenten-Parsing auf Seitenebene. Das Modell basiert auf Qwen3.5-0.8B und wandelt Dokumentbilder direkt in strukturiertes Markdown mit Tabellen, LaTeX-Formeln und Bild-Bounding-Boxes um.
Aus Video: Testing Alibaba Ovis-OCR2: Compact 0.8B Model for Document Parsing
