公開日 On the Complexity of Correlated Equilibria Beyond Normal-Form Games Ioannis Anagnostides, Constantinos Daskalakis, Gabriele Farina, Noah Golowich, Tuomas Sandholm, Brian Hu Zhang May 2026 arXiv | May 2026
公開日 Beyond GRPO and On-Policy Distillation: An Empirical Sparse-to-Dense Reward Principle for Language-Model Post-Training Yuan Xu, Hejian Sang, Zhengze Zhou, Ran He, Zhipeng Wang, A. Geramifard May 2026 arXiv | May 2026
公開日 Language Modeling with Hyperspherical Flows Justin Deschenaux, Caglar Gulcehre May 2026 arXiv | May 2026
公開日 Online Steiner Forest with Recourse Yaowei Long, Sepideh Mahabadi, Sherry Sarkar, Jakub Tarnawski ICALP 2026 | May 2026
公開日 Can Revealed Preferences Clarify LLM Alignment and Steering? K. Yamin, Jingjing Tang, Eric Horvitz, Bryan Wilder May 2026 arXiv | May 2026
公開日 Abductive Reasoning with Probabilistic Commonsense Joseph Cotnareanu, Chiara Roverato, Hang Zhou, Didier Chételat, Yingxue Zhang, Mark Coates May 2026 arXiv | May 2026
公開日 Agentic-imodels: Evolving agentic interpretability tools via autoresearch Chandan Singh, Yuting Tan, Weijia Xu, Zelalem Gero, Weiwei Yang, Michel Galley, Jianfeng Gao May 2026 arXiv | May 2026
公開日 Certified Qualitative Analysis of the SIR ODE and Reusable Scalar Lemmas in Isabelle/HOL D. B. Hulak, A. Ramos, Ruy J. G. B. de Queiroz May 2026 arXiv | May 2026
公開日 MAGIC: Multi-Step Advantage-Gated Causal Influence for Multi-agent Reinforcement Learning Haohan Yu, Jinmiao Cong, Shengzhi Wang, Lu Wang, Chanjuan Liu May 2026 arXiv | May 2026
公開日 Decentralized Asynchronous Multi-player Bandits Jingqi Fan, Canzhe Zhao, Shuai Li, Siwei Wang 25th International Conference on Autonomous Agents and Multiagent Systems (Extended Abstract) | May 2026