Theo Lang
theolang97
AI & ML interests
Multimodal learning, vision-language models, image captioning, cross-modal retrieval
Recent Activity
upvoted a paper about 1 hour ago
CoVA-SFT: A Large-Scale Dataset for Chain of Visual Abstractions upvoted a paper about 1 hour ago
Learning Where Outcomes Change:Credit-Addressable Reasoning for Multimodal Geometry upvoted a paper about 1 hour ago
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous DrivingOrganizations
None yet