Papers
Can Linguistically Related Languages Guide LLM Translation in Low-Resource Settings?
Aishwarya Ramasethu, Rohin Garg, Niyathi Allu et al.
Can LLM Agents Simulate Multi-Turn Human Behavior? Evidence from Real Online Customer Behavior Data
Yuxuan Lu, Jing Huang, Yan Han et al.
Can LLMs Act as Historians? Evaluating Historical Research Capabilities of LLMs via the Chinese Imperial Examination
Lirong Gao, Zeqing Wang, Yuyan Cai et al.
Can LLM Safety Be Ensured by Constraining Parameter Regions?
Zongmin Li, Jian Su, Farah Benamara et al.
Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language Models
Tianyi Zhou, Johanne Medina, Sanjay Chawla
Can LLMs Estimate Cognitive Complexity of Reading Comprehension Items?
Seonjeong Hwang, Hyounghun Kim, Gary Lee
Can LLMs Identify Tax Abuse?
Andrew Blair-Stanek, Nils Holzenberger, Benjamin Van Durme
Can LLMs Learn to Map the World from Local Descriptions?
Sirui Xia, Aili Chen, Xintao Wang et al.
Can LLMs Reason Like Doctors? Exploring the Limits of Large Language Models in Complex Medical Reasoning
Flavio Merenda, Jose Manuel Gomez-Perez, German Rigau
Can LLMs reason over extended multilingual contexts? Towards long-context evaluation beyond retrieval over haystacks
Amey Hengle, Prasoon Bajpai, Soham Dan et al.
Can LLMs Translate Italy’s Language Varieties?
Edoardo Signoroni, Pavel Rychlý
Can LLMs Truly Embody Human Personality? Analyzing AI and Human Behavior Alignment in Dispute Resolution
Deuksin Kwon, Kaleen Shrestha, Bin Han et al.
Can MLLMs Find Their Way in a City? Exploring Emergent Navigation from Web-Scale Knowledge
Dwip Dalal, Utkarsh Mishra, Narendra Ahuja et al.
Can Models Help Us Create Better Models? Evaluating LLMs as Data Scientists
Michał Pietruszka, Łukasz Borchmann, Aleksander Jędrosz et al.
Can Molecular Evolution Mechanism Enhance Molecular Representation?
Kun Li, Longtao Hu, Jiameng Chen et al.
Can Persona-Prompted LLMs Emulate Subgroup Values? An Empirical Analysis of Generalisability and Fairness in Cultural Alignment
Bryan Chen Zhengyu Tan, Zhengyuan Liu, Xiaoyuan Yi et al.
Can Protective Watermarking Safeguard the Copyright of 3D Gaussian Splatting?
Wenkai Huang, Yijia Guo, Gaolei Li et al.
Can Pseudo-Label Be More Reliable? A Simple yet Effective Topology-Aware Graph Self-Training Method
Gen Liu, Zhongying Zhao, Hui Zhou et al.
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
Jingwei Ni, Yu Fan, Vilém Zouhar et al.
Can Reasoning Path still be Effective as Input? Bridging Post-Reasoning to Chain-of-Thought Compression
Chengzhengxu Li, Xiaoming Liu, Zhaohan Zhang et al.
Can Spectral-Clipping Enable Better Learning While Forgetting Less for Low-Rank Adaptation?
Hyowon Wi, Noseong Park
CANVAS: A Benchmark for Vision-Language Models on Tool-Based User Interface Design
Daeheon Jeong, Seoyeon Byun, Kihoon Son et al.
Can Vision Language Models Track a Heartbeat? A Benchmark on Frame-Level Echocardiogram Understanding
Dingming Liu, Nabil Jabareen, Soeren Lukassen
Can We Challenge Open-Vocabulary Object Detectors with Generated Content in Street Scenes?
Annika Mütze, Sadia Ilyas, Christian Dörpelkus et al.
Can We Predict Before Executing Machine Learning Agents?
Jingsheng Zheng, Jintian Zhang, Yujie Luo et al.