Papers
Digging into Intrinsic Contextual Information for High-fidelity 3D Point Cloud Completion
Jisheng Chu, Wenrui Li, Xingtao Wang et al.
Digi-Q: Learning VLM Q-Value Functions for Training Device-Control Agents
Hao Bai, Yifei Zhou, Li Erran Li et al.
Digital Gatekeepers: Google’s Role in Curating Hashtags and Subreddits
Amrit Poudel, Yifan Ding, Tim Weninger et al.
DigitalLLaVA: Incorporating Digital Cognition Capability for Physical World Comprehension in Multimodal LLMs
Shiyu Li, Pengxu Wei, Pengchong Qiao et al.
Digital Twin Catalog: A Large-Scale Photorealistic 3D Object Digital Twin Dataset
Zhao Dong, Ka Chen, Zhaoyang Lv et al.
DiGIT: Multi-Dilated Gated Encoder and Central-Adjacent Region Integrated Decoder for Temporal Action Detection Transformer
Ho-Joong Kim, Yearang Lee, Jung-Ho Hong et al.
DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention
Lianghui Zhu, Zilong Huang, Bencheng Liao et al.
DIH-CLIP: Unleashing the Diversity of Multi-Head Self-Attention for Training-Free Open-Vocabulary Semantic Segmentation
Songsong Duan, Xi Yang, Nannan Wang
DiHuR: Diffusion-Guided Generalizable Human Reconstruction
Jinnan Chen, Chen Li, Gim Hee Lee
DIIN: Diffusion Iterative Implicit Networks for Arbitrary-scale Super-resolution
Tao Dai, Song Wang, Hang Guo et al.
DiL: An Explainable and Practical Metric for Abnormal Uncertainty in Object Detection
Amit Giloni, Omer Hofman, Ikuya Morikawa et al.
DIMCIM: A Quantitative Evaluation Framework for Default-mode Diversity and Generalization in Text-to-Image Generative Models
Revant Teotia, Candace Ross, Karen Ullrich et al.
Dimension Agnostic Neural Processes
Hyungi Lee, Chaeyun Jang, Dong Bok Lee et al.
Dimension Reduction for Symbolic Regression
Paul Kahlmeyer, Markus Fischer, Joachim Giesen
Dimension Reduction with Locally Adjusted Graphs
Yingfan Wang, Yiyang Sun, Haiyang Huang et al.
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Decoupled Video Diffusion
Wenqiang Sun, Shuo Chen, Fangfu Liu et al.
Di[M]O: Distilling Masked Diffusion Models into One-step Generator
Yuanzhi Zhu, Xi Wang, Stéphane Lathuilière et al.
DIMO: Diverse 3D Motion Generation for Arbitrary Objects
Linzhan Mou, Jiahui Lei, Chen Wang et al.
DiMo-GUI: Advancing Test-time Scaling in GUI Grounding via Modality-Aware Visual Reasoning
Hang Wu, Hongkai Chen, Yujun Cai et al.
DiMPLe - Disentangled Multi-Modal Prompt Learning: Enhancing Out-Of-Distribution Alignment with Invariant and Spurious Feature Separation
Umaima Rahman, Mohammad Yaqub, Dwarikanath Mahapatra
DiMSOD: A Diffusion-Based Framework for Multi-Modal Salient Object Detection
Shuo Zhang, Jiaming Huang, Wenbing Tang et al.
DiNaM: Disinformation Narrative Mining with Large Language Models
Witold Sosnowski, Arkadiusz Modzelewski, Kinga Skorupska et al.
DiN: Diffusion Model for Robust Medical VQA with Semantic Noisy Labels
Erjian Guo, Zhen Zhao, Zicheng Wang et al.
Dinomaly: The Less Is More Philosophy in Multi-Class Unsupervised Anomaly Detection
Jia Guo, Shuai Lu, Weihang Zhang et al.