Model weights of paper "Let ViT Speak: Generative Language-Image Pre-training"
Yan Fang
YanFang
AI & ML interests
Computer Vision, Incremental Learning, semi-supervised learning
Recent Activity
liked a model about 18 hours ago
Qwen/Qwen3.8-Flash-Next upvoted a paper 14 days ago
StateFlow: Building, Evolving, and Accessing 3D World States for Previsualization upvoted a paper about 1 month ago
UniVR: Thinking in Visual Space for Unified Visual ReasoningOrganizations
None yet