Co-occurring keywords
Papers
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
CVPR 2025
Anyattack: Towards Large-scale Self-supervised Adversarial Attacks on Vision-language Models
CVPR 2025
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
CVPR 2025
Understanding Fine-tuning CLIP for Open-vocabulary Semantic Segmentation in Hyperbolic Space
CVPR 2025
Mitigating Hallucinations in Large Vision-Language Models via DPO: On-Policy Data Hold the Key
CVPR 2025
UPME: An Unsupervised Peer Review Framework for Multimodal Large Language Model Evaluation
CVPR 2025
PerLA: Perceptive 3D Language Assistant
CVPR 2025