IDEFICS2
ModelEight-billion-parameter multimodal model supporting image and text inputs, document understanding, OCR, and visual reasoning.
- Apr 17, 2024
- —
- textimage
- Yes
- —
- 1
Releases
Apr 17, 2024IDEFICS2 releasedModel release
Hugging Face released IDEFICS2, an 8B visual-language model with stronger OCR, document, and visual reasoning capabilities.

