Papers
Beyond IVR: Benchmarking Customer Support LLM Agents for Business-Adherence
Sumanth Balaji, Piyush Mishra, Aashraya Sachdeva et al.
Beyond Length: Context-Aware Expansion and Independence as Developmentally Sensitive Evaluation in Child Utterances
Jiyun Chun, Eric Fosler-Lussier, Michael White et al.
Beyond Literal Mapping: Benchmarking and Improving Non-Literal Translation Evaluation
Yanzhi Tian, Cunxiang Wang, Zeming Liu et al.
Beyond Local Patterns: Multiscale Inconsistency Learning for Graph Anomaly Detection
Jie Lian, Zhihao Wu, Jielong Lu et al.
Beyond Machine Interpretation: Learning from Expert Over-Reads Improves ECG Diagnosis
Sunwoo Kwak, Fengbei Liu, Nusrat B. Nizam et al.
Beyond Majority Voting: Towards Fine-grained and More Reliable Reward Signal for Test-Time Reinforcement Learning
Weiqin Wang, Yile Wang, Kehao Chen et al.
Beyond Many-Shot Translation: Scaling In-Context Demonstrations For Low-Resource Machine Translation
Luis Frentzen Salim, Esteban Carlin, Alexandre Morinvil et al.
Beyond Markovian Forgetfulness: Episodic Memory for Reasoning-Intensive Retrieval
Dohyeon Lee, Yeonseok Jeong, Seung-won Hwang
Beyond Math: Stories as a Testbed for Memorization-Constrained Reasoning in LLMs
Yuxuan Jiang, Francis Ferraro
Beyond Memorization: A Rigorous Evaluation Framework for Medical Knowledge Editing
Shigeng Chen, Linhao Luo, Zhangchi Qiu et al.
Beyond Meta-Reasoning: Metacognitive Consolidation for Self-Improving LLM Reasoning
Ziqing Zhuang, Linhai Zhang, Jiasheng Si et al.
Beyond Missing Data Imputation: Information-Theoretic Coupling of Missingness and Class Imbalance for Optimal Irregular Time Series Classification
Xin Qin, Mengna Liu, Wenjie Wang et al.
Beyond Monolingual Assumptions: A Survey on Code-Switched NLP in the Era of Large Language Models across Modalities
Rajvee Sheth, Samridhi Raj Sinha, Mahavir Patil et al.
Beyond Monotonicity: Revisiting Factorization Principles in Multi-Agent Q-Learning
Tianmeng Hu, Yongzheng Cui, Rui Tang et al.
Beyond MSE: Ordinal Cross-Entropy for Probabilistic Time Series Forecasting
Jieting Wang, Huimei Shi, Feijiang Li et al.
Beyond Multiple Choice: Evaluating Steering Vectors for Summarization
Joschka Braun, Carsten Eickhoff, Seyed Ali Bahrainian
Beyond Musical Descriptors: Extracting Preference-Bearing Intent in Music Queries
Marion Baranes, Romain Hennequin, Elena V. Epure
Beyond Names: How Grammatical Gender Markers Bias LLM-based Educational Recommendations
Luca Benedetto, Antonia Donvito, Alberto Lucchetti et al.
Beyond Natural Images: A Dual-Stream DINOv3 Framework for PET/CT Segmentation
Yu-Nong Scarlett Lin, Shansong Wang, Mojtaba Safari et al.
Beyond Next Token Probabilities: Learnable, Fast Detection of Hallucinations and Data Contamination on LLM Output Distributions
Guy Bar-Shalom, Fabrizio Frasca, Derek Lim et al.
Beyond N-grams: A Hierarchical Reward Learning Framework for Clinically-Aware Medical Report Generation
Yuan Wang, Shujian Gao, Jiaxiang Liu et al.
Beyond Noise: Characterizing Creative Potential in Unverifiable LLM Hallucinations
Yu Yan, Chunhong Zhang, Haiyu Zhao et al.
Beyond "Not Novel Enough": Enriching Scholarly Critique with LLM-Assisted Feedback
Osama Mohammed Afzal, Preslav Nakov, Tom Hope et al.