
Description
Document recognition and image understanding usually chain several models in fragile pipelines. This repo provides inference for TII's Falcon-Perception and Falcon-OCR multimodal models.
Early-fusion, natively multimodal models handle images and text together for OCR and visual understanding.
Multimodal:Early fusion.
OCR:Documents.
Vision:Image Q&A.
Open:Run locally.
Early-fusion, natively multimodal models handle images and text together for OCR and visual understanding.
Features
Multimodal:Early fusion.
OCR:Documents.
Vision:Image Q&A.
Open:Run locally.
