RISys-Lab
Multimodal Learning, Foundational Models, AI Safety
Pinned Loading
Repositories
Showing 5 of 5 repositories
- ReasonCLIP Public
[ECCV 2026] Visually Grounded Commonsense Reasoning Surpervison for CLIP-like Models
- LingT2I Public
[ACM MM 2026] On the Limitations of Cross-Lingual Consistency in Multilingual Text-to-Image Generation
- SPARROW Public
[CVPR 2026] SPARROW: Learning Spatial Precision and Temporal Referential Consistency in Pixel-Grounded Video MLLMs
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…