Publication Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning Zhaoyang Wang, Canwen Xu, Boyi Liu, Yite Wang, Siwei Han, Zhewei Yao, Huaxiu Yao, Yuxiong He ICML 2026 | February 2026
Publication MedFeat: Model-Aware and Explainability-Driven Feature Engineering with LLMs for Clinical Tabular Prediction Zizheng Zhang, Yiming Li, Justin Xu, Jinyu Wang, Rui Wang, Lei Song, Jiang Bian, David W Eyre, Jingjing Fu February 2026 arXiv | February 2026
Publication Harvest: Adaptive Photonic Switching Schedules for Collective Communication in Scale-up Domains Mahir Rahman, Samuel Joseph, Nihar Kodkani, Behnaz Arzani, Vamsi Addanki SIGCOMM 2026 | February 2026
Publication Towards Active Synthetic Data Generation for Finetuning Language Models Samuel Kessler, Menglin Xia, Daniel Madrigal, Dongge Han, Helia Heshemi, Saravan Rajmohan, Victor Ruehle, Jordan Ash 2026 COLM | February 2026
Publication Near-optimal Swap Regret Minimization for Convex Losses Lunjia Hu, Jon Schneider, Yifan Wu February 2026 arXiv | February 2026
Publication ARO: A New Lens On Matrix Optimization For Large Models Wenbo Gong, Javier Zazo, Qijun Luo, Puqian Wang, James Hensman, Chao Ma February 2026 February 2026 Video
Publication GOT-Edit: Geometry-Aware Generic Object Tracking via Online Model Editing Shih-Fang Chen, Jun-Cheng Chen, I-Hong Jhuo, Yen-Yu Lin ICLR 2026 | February 2026
Publication Welfarist Formulations for Diverse Similarity Search Siddharth Barman, Nirjhar Das, Shivam Gupta, Kiran Shiragur ICLR 2026 | February 2026 Project
Publication Beyond Correctness: Learning Robust Reasoning via Transfer Hyunseok Lee, Soheil Abbasloo, Jihoon Tack, Jinwoo Shin February 2026 arXiv | February 2026
Publication Statistical Estimation of Adversarial Risk in Large Language Models under Best-of-N Sampling Mingqian Feng, Xiaodong Liu, Weiwei Yang, Chenliang Xu, Chris White, Jianfeng Gao February 2026 arXiv | February 2026 Github