arxiv:2505.04410
Junjie Wang
xiaomoguhzz
AI & ML interests
computer vision, Vision-Language Models, Multimodal Large Language Models
Recent Activity
updated a model 14 days ago
xiaomoguhzz/VisionEncoder updated a dataset 27 days ago
xiaomoguhzz/codex-ppt-temp-visual-encoder-assets published a dataset 27 days ago
xiaomoguhzz/codex-ppt-temp-visual-encoder-assets