Violet: A Vision-Language model for generating Arabic image captions using a Gemini Decoder and pretrained transformer.
-
Updated
Apr 11, 2025 - Jupyter Notebook
Violet: A Vision-Language model for generating Arabic image captions using a Gemini Decoder and pretrained transformer.
To associate your repository with the gemini-decoder topic, visit your repo's landing page and select "manage topics."