Haruto Sato
harutosato2001
AI & ML interests
Multimodal learning, vision-language models, image captioning, cross-modal retrieval
Recent Activity
liked a dataset about 3 hours ago
hassan-wajid/Spatial-Blind-Spots-in-Vision-Language-Models liked a dataset about 3 hours ago
n1ghtf4l1/Agentic-Diagnostic-Reasoning-with-Multimodal-SLMs-via-Reinforcement-Learning liked a model 1 day ago
gabrielamarques/paper_015384925_visual_question_answeringOrganizations
None yet