Papers
Bi-VLM: Binary Post-Training Quantization for Vision-Language Models
Xijun Wang, Rayyan Abdalla, Junyun Huang et al.
Black-Box Membership Inference Attacks for Video Training Data in Multimodal Large Language Models
Jinrui Wang, Zhenfeng Gao, Wendan Wang et al.
BLADE: A Behavior-Level Data Augmentation Framework with Dual Fusion Modeling for Multi-Behavior Sequential Recommendation
Yupeng Li, Mingyue Cheng, Yucong Luo et al.
BlendCLIP: Bridging Synthetic and Real Domains for Zero-Shot 3D Object Classification with Multimodal Pretraining
Ajinkya Khoche, Gergő László Nagy, Maciej Wozniak et al.
BLEnD-Vis: Benchmarking Multimodal Cultural Understanding in Vision Language Models
Bryan Chen Zhengyu Tan, Weihua Zheng, Zhengyuan Liu et al.
Blessing of Dimensionality for Approximating Sobolev Classes on Manifolds
Hong Ye Tan, Subhadip Mukherjee, Junqi Tang et al.
BlindGuard: Safeguarding LLM-based Multi-Agent Systems under Unknown Attacks
Rui Miao, Yixin Liu, Yili Wang et al.
Blind Spot Navigation in Large Language Model Reasoning with Thought Space Explorer
Jinghan Zhang, Fengran Mo, Tharindu Cyril Weerasooriya et al.
BLM-Guard: Explainable Multimodal Ad Moderation with Chain-of-Thought and Policy-Aligned Rewards
Yiran Yang, Zhaowei Liu, Yuan Yuan et al.
Bloom-Eval: A Hierarchical Evaluation Benchmark for Automatic Survey Generation Based on Bloom’s Taxonomy
Fei Zhang, Zhe Zhao, HaiBin Wen et al.
Blur2Sharp: Human Novel Pose and View Synthesis with Generative Prior Refinement
Chia-Hern Lai, I-Hsuan Lo, Yen-Ku Yeh et al.
BLUR: A Bi-Level Optimization Approach for LLM Unlearning
Hadi Reisizadeh, Jinghan Jia, Zhiqi Bu et al.
Blur-Robust Detection via Feature Restoration: An End-to-End Framework for Prior-Guided Infrared UAV Target Detection
Xiaolin Wang, Houzhang Fang, Qingshan Li et al.
BOFA: Bridge-Layer Orthogonal Low-Rank Fusion for CLIP-Based Class-Incremental Learning
Lan Li, Tao Hu, Da-Wei Zhou et al.
BokehCrafter: Taming Video Diffusion Models for Controllable Bokeh Rendering
Qiwen Wang, Liao Shen, Jiaqi Li et al.
BokehFlow: Depth-Free Controllable Bokeh Rendering via Flow Matching
Yachuan Huang, Xianrui Luo, Qiwen Wang et al.
Bolster Hallucination Detection via Prompt-Guided Data Augmentation
Wenyun Li, Zheng Zhang, Dongmei Jiang et al.
Bonsai: Interpretable Tree-Adaptive Grounded Reasoning
Kate Sanders, Benjamin Van Durme
BOOM: Beyond Only One Modality KIT’s Multimodal Multilingual Lecture Companion
Sai Koneru, Fabian Retkowski, Christian Huber et al.
Boomda: Balanced Multi-objective Optimization for Multimodal Domain Adaptation
Jun Sun, Xinxin Zhang, Simin Hong et al.
Boosting Adversarial Transferability via Ensemble Non-Attention
Yipeng Zou, Qin Liu, Jie Wu et al.
Boosting ASR Robustness via Test-Time Reinforcement Learning with Audio-Text Semantic Rewards
Linghan Fang, Tianxin Xie, Li Liu
Boosting Cross-problem Generalization in Diffusion-Based Neural Combinatorial Solver via Inference Time Adaptation
Haoyu Lei, Kaiwen Zhou, Yinchuan Li et al.
Boosting Fine-Grained Urban Flow Inference via Lightweight Architecture and Focalized Optimization
Yuanshao Zhu, Xiangyu Zhao, Zijian Zhang et al.
Boosting Medical Vision-Language Pretraining via Momentum Self-Distillation under Limited Computing Resources
Phuc Pham, Nhu Pham, Ngoc Quoc Ly