DRISHTI-Bn
Parameter-efficient multimodal vision-language framework (ViT-B/16 + BanglaBERT, LoRA r=8, α=16) for flood damage classification and Bengali caption generation. Trained on 3,755 CrisisMMD flood images with machine-translated Bengali annotations.
- PyTorch
- ViT-B/16
- BanglaBERT
- LoRA
- Multimodal