Publication CodeClinic: Evaluating Automation of Coding Skills for Clinical Reasoning Agents Timothy Ossowski, Xinchi Liu, Danyal Maqbool, Vaibhav Dhanuka, Sheng Zhang, Hoifung Poon, Majid Afshar, Tyler J. Bradshaw, Junjie Hu May 2026 arXiv | May 2026
Publication Oracle Poisoning: Corrupting Knowledge Graphs to Weaponise AI Agent Reasoning Ben Kereopa-Yorke, Guillermo Díaz, Holly Wright, Reagan Johnston, Ron F. Del Rosario, Timothy Lynar May 2026 arXiv | May 2026
Publication Online Steiner Forest with Recourse Yaowei Long, Sepideh Mahabadi, Sherry Sarkar, Jakub Tarnawski ICALP 2026 | May 2026
Publication Security Risks in Tool-Enabled AI Agents: A Systematic Analysis of Privileged Execution Environments Hardik Goel May 2026 arXiv | May 2026
Publication Position: Avoid Overstretching LLMs for every Enterprise Task Kuldeep Singh, Anson Bastos, Isaiah Onando Mulang May 2026 arXiv | May 2026
Publication EvidenT: An Evidence-Preserving Framework for Iterative System-Level Package Repair Chenyu Zhao, Minghua Ma, Shenglin Zhang, Zeshun Huang, Yongqian Sun, Chetan Bansal, Saravan Rajmohan, Dan Pei May 2026 arXiv | May 2026
Publication Generating Leakage-Free Benchmarks for Robust RAG Evaluation Jiayi Liu, Jiaxing Zhang, Bowen Jin, Jennifer Neville May 2026 arXiv | May 2026
Publication SkillGen: Verified Inference-Time Agent Skill Synthesis Yuchen Ma, Yue Huang, Han Bao, Haomin Zhuang, Swadheen Shukla, Michel Galley, Xiangliang Zhang, Stefan Feuerriegel May 2026 arXiv | May 2026
Publication From Articulated Kinematics to Routed Visual Control for Action-Conditioned Surgical Video Generation Bohan Li, Shuo Yang, Bao Peng, Xianda Guo, Erli Zhang, Youqi Tao, Junfeng Duan, Daguang Xu, Qi Dou, Xin Jin, Wenjun Zeng, Hao Zhao, Yueming Jin May 2026 arXiv | May 2026
Publication Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents Chenyu Zhao, Shenglin Zhang, Yihang Lin, Wenwei Gu, Zhiming Chen, Yongqian Sun, Dan Pei, Chetan Bansal, Saravan Rajmohan, Minghua Ma May 2026 arXiv | May 2026