Publication “Nobody Did This”: Contribution, Originality, and Accountability in Agent-Mediated Collaboration Kashif Imteyaz, M. Rifat, Divya Ramesh, Steven R. Rick, S. Hosio, Hauke Sandhaus, Advait Sarkar, Christoph Riedl, Saiph Savage July 2026 arXiv | July 2026
Publication Echoverse: Deep, Evolving Environments for Training Computer-Use Agents at Scale Yash Pandya, Sahil Gupta, Sarthak Harne, Archana Yadav, Kavyansh Chourasia, Hussein Mozannar, Vibhav Vineet, Sara Abdali, Corby Rosset, Yash Lara, Ahmed Awadallah, Ece Kamar, Akshay Nambi July 2026
Publication Plans Work in Mysterious Ways: Evaluating a Plan Mode for Spreadsheet Agents Aayush Kumar, Avik Dutta, Sumit Gulwani, Gustavo Soares, Advait Sarkar, Emerson Murphy-Hill IEEE VL/HCC 2026 | July 2026
Publication “Maybe We Need Some More Examples:” Individual and Team Drivers of Developer GenAI Tool Use Courtney Miller, Rudrajit Choudhuri, Mara Ulloa, Sankeerti Haniyur, Robert DeLIne, Margaret-Anne Storey, Emerson Murphy-Hill, Christian Bird, Jenna Butler 2026 International Conference on Software Engineering | July 2026
Publication Specula: Scaling formal specifications for autonomous model checking of system code Q. Cheng, Saad Mohammad Rafid Pial, Ruize Tang, Yiming Su, Emilie Ma, Finn Hackett, Ivan Beschastnikh, Yu Huang, Tianyin Xu July 2026 arXiv | July 2026
Publication Weak-to-Strong On-Policy Distillation Fangxu Yu, Zinan Lin, Xiaodong Liu, Weijia Xu, Michael Xu, Tianyi Zhou, Jianfeng Gao July 2026 arXiv | July 2026
Publication Harm is not Universal: Community-Specific Toxicity Detection is Urgently Needed Xinnuo Xu, Anja Thieme, Daniela Massiceti, Ioana Tănase, Rita Faia Marques, Melanie Fernandez Pradier, Martin Grayson, Camilla Longden, Cecily Morrison July 2026 arXiv | July 2026
Publication ERR@HRI 3.0 Challenge: Multimodal Detection of Errors and Anticipation in Human-Robot Interactions Maria Teresa Parreira, Micol Spitale, Maia Stiber, Shiye Cao, Amama Mahmood, Chien-Ming Huang, Hatice Gunes, Wendy Ju arXiv
Publication A Few Words Go a Long Way: Language Guided Robot Policy Synthesis Daphne Chen, Abha Jain, E. Goossen, Emma Romig, Michael Murray, Nick Walker, Maya Cakmak July 2026 arXiv | July 2026
Publication Training Language Models to Cooperate with Inference-Time Controllers Moumita Choudhury, Vanshaj Khattar, Jing Liu, T. Koike-Akino, Ankush Chakrabarty, S. Zilberstein, Ye Wang July 2026 arXiv | July 2026