Papers
AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts
Keyu Li, Junhao Shi, Yang Xiao et al.
A General Anchor-Based Framework for Scalable Fair Clustering
Shengfei Wei, Suyuan Liu, Jun Wang et al.
A General Highly Accurate Online Planning Method Integrating Large Language Models into Nested Rollout Policy Adaptation for Dialogue Tasks
Hui Wang, Fafa Zhang, Xiaoyu Zhang et al.
AgentAsk: Multi-Agent Systems Need to Ask
Bohan Lin, Kuo Yang, Zelin Tan et al.
Agent-based Substructure Counting under Local Differential Privacy
Yuting Zhang, Kai Wang, Wei Ni et al.
AgentCDM: Enhancing Multi-Agent Collaborative Decision-Making via ACH-Inspired Structured Reasoning
Xuyang Zhao, Shiwan Zhao, Hualong Yu et al.
AgentCoMa: A Compositional Benchmark Mixing Commonsense and Mathematical Reasoning in Real-World Scenarios
Lisa Alazraki, Lihu Chen, Ana Brassard et al.
AgentFactory: A Self-Evolving Framework Through Executable Subagent Accumulation and Reuse
Zhang Zhang, Shuqi Lu, Hongjin Qian et al.
AgentGL: Towards Agentic Graph Learning with LLMs via Reinforcement Learning
Yuanfu Sun, Kang Li, Dongzhe Fan et al.
AgentGraph: Trace-to-Graph Platform for Interactive Analysis and Robustness Testing in Agentic AI Systems
Zekun Wu, Seonglae Cho, Cristian Enrique Munoz Villalobos et al.
AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments
Zhiheng Xi, Dingwen Yang, Jiaqi Liu et al.
Agentic AI for Human Resources: LLM-Driven Candidate Assessment
Kamer Ali Yuksel, Abdul Basit Anees, Ashraf Hatim Elneima et al.
Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents
Asaf Yehudai, Lilach Eden, Michal Shmueli-Scheuer
Agentic Context Strategies for Multi-Format Document Understanding: When Should Language Models Use Tools?
Mansi Uniyal, Mukul Singh, Ryan Nadel
Agentic Design Review System
Sayan Nag, Joseph K J, Koustava Goswami et al.
Agentic Economic Modeling
Bohan Zhang, Jiaxuan Li, Ali Hortacsu et al.
Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents
Yi Yu, Liuyi Yao, Yuexiang Xie et al.
Agentic Oversight via Dialectic Reasoning
Leonardo Ranaldi, Federico Ranaldi
AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use
Yuanjie Lyu, Chengyu Wang, Haonan Zheng et al.
Agentic Rubrics as Contextual Verifiers for SWE Agents
Mohit Raghavendra, Anisha Gunjal, Bing Liu et al.
Agentic Solutions for IT Financial Operations
Bekir O. Turkkan, Pavankumar Murali, Chandrasekhar Narayanaswami et al.
Agentic Very Long Video Understanding
Aniket Rege, Arka Sadhu, Yuliang Li et al.
Agent Journey Beyond RGB: Hierarchical Semantic-Spatial Representation Enrichment for Vision-and-Language Navigation
Xuesong Zhang, Yunbo Xu, Jia Li et al.
Agentmandering: A Game-Theoretic Framework for Fair Redistricting via Large Language Model Agents
Hao Li, Haotian Chen, Ruoyuan Gong et al.