Publication Lost in Transmission: When and Why LLMs Fail to Reason Globally Tobias Schnabel, Kiran Tomlinson, Adith Swaminathan, Jennifer Neville NeurIPS 2025 | December 2025 NeurIPS Spotlight Github
Publication Improved Algorithms for Fair Matroid Submodular Maximization Sepideh Mahabadi, Sherry Sarkar, Jakub Tarnawski NeurIPS 2025 | December 2025
Publication MetroRLHF: Enabling Memory-Effective Training for On-Policy RLHF via Adaptive Sequence Streaming Wei Cui, Peng Cheng Efficient Reasoning @ NeurIPS 2025 | December 2025
Publication Mechanism Design for LLM Fine-tuning with Multiple Reward Models Haoran Sun, Yurong Chen, Siwei Wang, Xu Chu, Wei Chen, Xiaotie Deng Neural Information Processing Systems (NeurIPS) 2025 | December 2025
Publication On the Coordination of Value-Maximizing Bidders Yanru Guan, Jiahao Zhang, Zhe Feng, Tao Lin November 2025
Publication TwT: Thinking without Tokens by Habitual Reasoning Distillation with Multi-Teachers’ Guidance Jingxian Xu, Mengyu Zhou, Weichang Liu, Hanbing Liu, Shi Han, Dongmei Zhang The 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP ’25) | November 2025
Publication Attention Enhanced Entity Recommendation for Intelligent Monitoring in Cloud Systems Fiza Hussain, Anson Bastos, A. Parayil, Ayush Choure, Chetan Bansal, Rujia Wang, Saravan Rajmohan October 2025 October 2025
Publication A Unified Approach to Submodular Maximization Under Noise Kshipra Bhawalkar, Yang Cai, Zhe Feng, Christopher Liaw, Tao Lin NeurIPS 2025 | October 2025
Publication Efficient and Near-Optimal Algorithm for General Contextual Dueling Bandits with Offline Regression Oracles Aadirupa Saha, Robert E. Schapire NeurIPS 2025 | October 2025
Publication Parameter-Free Last-Iterate Convergence of Counterfactual Regret Minimization Algorithms Linjian Meng, Youzhi Zhang, Shangdong Yang, Tianyu Ding, Zhenxing Ge, Wenbin Li, Tianpei Yang, Bo An, Yang Gao NeurIPS 2025 | October 2025