Papers
Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives
Wang Qinsi, Jinghan Ke, Masayoshi Tomizuka et al.
Doc2Chart: Intent-Driven Zero-Shot Chart Generation from Documents
Akriti Jain, Pritika Ramu, Aparna Garimella et al.
DocAgent: A Multi-Agent System for Automated Code Documentation Generation
Dayu Yang, Antoine Simoulin, Xin Qian et al.
DocAgent: An Agentic Framework for Multi-Modal Long-Context Document Understanding
Li Sun, Liu He, Shuyue Jia et al.
DocAssistant: Integrating Key-region Reading and Step-wise Reasoning for Robust Document Visual Question Answering
Jinxu Zhang, Qiyuan Fan, Yu Zhang
DocBench: A Benchmark for Evaluating LLM-based Document Reading Systems
Anni Zou, Wenhao Yu, Hongming Zhang et al.
DocFusion: A Unified Framework for Document Parsing Tasks
Mingxu Chai, Ziyu Shen, Chong Zhang et al.
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
Dayyán O’Brien, Bhavitvya Malik, Ona de Gibert et al.
DoCIA: An Online Document-Level Context Incorporation Agent for Speech Translation
Xinglin Lyu, Wei Tang, Yuang Li et al.
DocIE@XLLM25: In-Context Learning for Information Extraction using Fully Synthetic Demonstrations
Nicholas Popovic, Ashish Kangen, Tim Schopf et al.
DocIE@XLLM25: UIEPrompter: A Unified Training-Free Framework for universal document-level information extraction via Structured Prompt
Chengfeng Qiu, Lifeng Zhou, Kaifeng Wei et al.
DocIE@XLLM25: ZeroSemble - Robust and Efficient Zero-Shot Document Information Extraction with Heterogeneous Large Language Model Ensembles
Nguyen Pham Hoang Le, An Dinh Thien, Son T. Luu et al.
DocKylin: A Large Multimodal Model for Visual Document Understanding with Efficient Visual Slimming
Jiaxin Zhang, Wentao Yang, Songxuan Lai et al.
DocLayLLM: An Efficient Multi-modal Extension of Large Language Models for Text-rich Document Understanding
Wenhui Liao, Jiapeng Wang, Hongliang Li et al.
DocMamba: Efficient Document Pre-training with State Space Model
Pengfei Hu, Zhenrong Zhang, Jiefeng Ma et al.
DocMatcher: Document Image Dewarping via Structural and Textual Line Matching
Felix Hertlein, Alexander Naumann, York Sure-Vetter
DocMEdit: Towards Document-Level Model Editing
Li Zeng, Zeming Liu, Chong Feng et al.
DocMIA: Document-Level Membership Inference Attacks against DocVQA Models
Khanh Nguyen, Raouf Kerkouche, Mario Fritz et al.
DocMMIR: A Framework for Document Multi-modal Information Retrieval
Zirui Li, Siwei Wu, Yizhi Li et al.
Do Code Semantics Help? A Comprehensive Study on Execution Trace-Based Information for Code Large Language Models
Jian Jornbowrl Wang, Xiaofei Xie, Qiang Hu et al.
DO-CoLM: Dynamic 3D Conformation Relationships Capture with Self-Adaptive Ordering Molecular Relational Modeling in Language Models
Zhuo Chen, Jiahui Zhang, Sihan Wang et al.
Do Computer Vision Foundation Models Learn the Low-level Characteristics of the Human Visual System?
Yancheng Cai, Fei Yin, Dounia Hammou et al.
Do Construction Distributions Shape Formal Language Learning In German BabyLMs?
Bastian Bunzeck, Daniel Duran, Sina Zarrieß
Do Construction Distributions Shape Formal Language Learning In German BabyLMs?
Bastian Bunzeck, Daniel Duran, Sina Zarrieß