Papers
176,624 papers found
DocIE@XLLM25: ZeroSemble - Robust and Efficient Zero-Shot Document Information Extraction with Heterogeneous Large Language Model Ensembles
Nguyen Pham Hoang Le, An Dinh Thien, Son T. Luu et al.
DocKylin: A Large Multimodal Model for Visual Document Understanding with Efficient Visual Slimming
Jiaxin Zhang, Wentao Yang, Songxuan Lai et al.
DocLayLLM: An Efficient Multi-modal Extension of Large Language Models for Text-rich Document Understanding
Wenhui Liao, Jiapeng Wang, Hongliang Li et al.
DocMamba: Efficient Document Pre-training with State Space Model
Pengfei Hu, Zhenrong Zhang, Jiefeng Ma et al.
DocMatcher: Document Image Dewarping via Structural and Textual Line Matching
Felix Hertlein, Alexander Naumann, York Sure-Vetter
DocMEdit: Towards Document-Level Model Editing
Li Zeng, Zeming Liu, Chong Feng et al.
DocMMIR: A Framework for Document Multi-modal Information Retrieval
Zirui Li, Siwei Wu, Yizhi Li et al.
Do Code Semantics Help? A Comprehensive Study on Execution Trace-Based Information for Code Large Language Models
Jian Jornbowrl Wang, Xiaofei Xie, Qiang Hu et al.
DO-CoLM: Dynamic 3D Conformation Relationships Capture with Self-Adaptive Ordering Molecular Relational Modeling in Language Models
Zhuo Chen, Jiahui Zhang, Sihan Wang et al.
Do Computer Vision Foundation Models Learn the Low-level Characteristics of the Human Visual System?
Yancheng Cai, Fei Yin, Dounia Hammou et al.
Do Construction Distributions Shape Formal Language Learning In German BabyLMs?
Bastian Bunzeck, Daniel Duran, Sina Zarrieß
Do Construction Distributions Shape Formal Language Learning In German BabyLMs?
Bastian Bunzeck, Daniel Duran, Sina Zarrieß
Docopilot: Improving Multimodal Models for Document-Level Understanding
Yuchen Duan, Zhe Chen, Yusong Hu et al.
Doc-React: Multi-page Heterogeneous Document Question-answering
Junda Wu, Yu Xia, Tong Yu et al.
DocReRank: Single-Page Hard Negative Query Generation for Training Multi-Modal RAG Rerankers
Navve Wasserman, Oliver Heinimann, Yuval Golbari et al.
DocSAM: Unified Document Image Segmentation via Query Decomposition and Heterogeneous Mixed Learning
Xiao-Hui Li, Fei Yin, Cheng-Lin Liu
DocSpiral: A Platform for Integrated Assistive Document Annotation through Human-in-the-Spiral
Qiang Sun, Sirui Li, Tingting Bi et al.
DocThinker: Explainable Multimodal Large Language Models with Rule-based Reinforcement Learning for Document Understanding
Wenwen Yu, Zhibo Yang, Yuliang Liu et al.
DocTTT: Test-Time Training for Handwritten Document Recognition using Meta-Auxiliary Learning
Wenhao Gu, Li Gu, Ziqiang Wang et al.
Documentation Retrieval Improves Planning Language Generation
Renxiang Wang, Li Zhang
Documentation Retrieval Improves Planning Language Generation
Renxiang Wang, Li Zhang
Document Attribution: Examining Citation Relationships using Large Language Models
Vipula Rawte, Ryan A. Rossi, Franck Dernoncourt et al.
Document-Level Event-Argument Data Augmentation for Challenging Role Types
Joseph Gatto, Omar Sharif, Parker Seegmiller et al.
Document-Level Relation Extraction with Global Relations and Entity Pair Reasoning
Fu Zhang, Yi Yan, Jingwei Cheng
Document-level Simplification and Illustration Generation Multimodal Coherence
Yuhang Liu, Mo Zhang, Zhaoyi Cheng et al.