AI & ML interests

Multimodal AI, Vision-Language Models, Document Intelligence, OCR, Handwriting Recognition, Compact VLMs, Multimodal Post-Training, SFT, GRPO

Recent Activity

Dizzar  updated a dataset 9 days ago
multimodal-vision-ai/mvai-doctag-r3-v1
gptan75  updated a Space 15 days ago
multimodal-vision-ai/README
gptan75  published a Space 15 days ago
multimodal-vision-ai/README
View all activity

None public yet