Papers
Do It Yourself: Learning Semantic Correspondence from Pseudo-Labels
Olaf Dünkel, Thomas Wimmer, Christian Theobalt et al.
Do Language Models Mirror Human Confidence? Exploring Psychological Insights to Address Overconfidence in LLMs
Chenjun Xu, Bingbing Wen, Bin Han et al.
Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMs
Julia Watson, Sophia S. Lee, Barend Beekhuizen et al.
Do Language Models Understand Honorific Systems in Javanese?
Mohammad Rifqi Farhansyah, Iwan Darmawan, Adryan Kusumawardhana et al.
Do Language Models Understand the Cognitive Tasks Given to Them? Investigations with the N-Back Paradigm
Xiaoyang Hu, Richard Lewis
Do Large Language Models Align with Core Mental Health Counseling Competencies?
Viet Cuong Nguyen, Mohammad Taher, Dongwan Hong et al.
Do Large Language Models excel in Complex Logical Reasoning with Formal Language?
Jin Jiang, Jianing Wang, Yuchen Yan et al.
Do Large Language Models have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
Yanzhu Guo, Simone Conia, Zelin Zhou et al.
Do Large Language Models Have “Emotion Neurons”? Investigating the Existence and Role
Jaewook Lee, Woojin Lee, Oh-Woog Kwon et al.
Do Large Language Models Know Folktales? A Case Study of Yokai in Japanese Folktales
Ayuto Tsutsumi, Yuu Jinnai
Do Large Language Models Know When Not to Answer in Medical QA?
Sravanthi Machcha, Sushrita Yerra, Sharmin Sultana et al.
Do Large Language Models Learn Human-Like Strategic Preferences?
Jesse Roberts, Kyle Moore, Douglas Fisher
Do Large Language Models Mirror Cognitive Language Processing?
Yuqi Ren, Renren Jin, Tongxuan Zhang et al.
Do Large Language Models Perform Latent Multi-Hop Reasoning without Exploiting Shortcuts?
Sohee Yang, Nora Kassner, Elena Gribovskaya et al.
Do large language models solve verbal analogies like children do?
Tamar Johnson, Mathilde ter Veen, Rochelle Choenni et al.
Do large language models solve verbal analogies like children do?
Tamar Johnson, Mathilde ter Veen, Rochelle Choenni et al.
Do Large Language Models Truly Grasp Addition? A Rule-Focused Diagnostic Using Two-Integer Arithmetic
Yang Yan, Yu Lu, Renjun Xu et al.
Do Large Language Models Truly Understand Geometric Structures?
Xiaofeng Wang, Yiming Wang, Wenhong Zhu et al.
Do Large Language Models Understand Word Senses?
Domenico Meconi, Simone Stirpe, Federico Martelli et al.
DOLFIN - Document-Level Financial Test-Set for Machine Translation
Mariam Nakhle, Marco Dinarelli, Raheel Qader et al.
DOLLAR: Few-Step Video Generation via Distillation and Latent Reward Optimization
Zihan Ding, Chi Jin, Difan Liu et al.
Do LLM Agents Have Regret? A Case Study in Online Learning and Games
Chanwoo Park, Xiangyu Liu, Asuman E. Ozdaglar et al.
Do LLMs Adhere to Label Definitions? Examining Their Receptivity to External Label Definitions
Seyedali Mohammadi, Bhaskara Hanuma Vedula, Hemank Lamba et al.