Agent
Agent "agents-last-exam-2606.05405" from Mtrya/paper-scout, covering 1 introduction, 2 benchmark design and dataset construction, 2.3 task construction pipeline: how are the tasks created?, 3 evaluation pipeline and 3.1 pipeline architecture.
Agent
Agent "agents-last-exam-2606.05405" from Mtrya/paper-scout, covering 1 introduction, 2 benchmark design and dataset construction, 2.3 task construction pipeline: how are the tasks created?, 3 evaluation pipeline and 3.1 pipeline architecture.
Agent
Xucong Wang1,2∗ Ziyu Ma2∗ Yong Wang2† Yuxiang Ji2 Shidong Yang2 Guanhua Chen3 Pengkun Wang1† Xiangxiang Chu2 1University of Science and Technology of China 2AMAP, Alibaba Group 3Southern University of Science and Technology.
Agent
Title: ASPIRE: Agentic /Skills Discovery for Robotics.
Agent
Amy Xin1, Jiening Siow1, Junjie Wang1, Zijun Yao1, Fanjin Zhang2, Jian Song2, Lei Hou1, Juanzi Li1 1Department of Computer Science and Technology, Tsinghua University 2Zhipu AI {xin-x25, xiaojn25}@mails.tsinghua.edu.cn.
Agent
Haowen Liu1,∗, Xirui Li1,∗, Shaoxiong Yao2, Peng Shi3, Tianyi Zhou4, Jia-Bin Huang1, Furong Huang1, Jiayuan Mao5,6.
Agent
Title: Harness Handbook: Making Evolving Agent Harnesses Readable, Navigable, and Editable.
Agent
Agent "harnessx-2606.14249" from Mtrya/paper-scout, covering abstract, 1 introduction, 2 related work, 2.1 harness engineering and 2.2 self-evolving agents.
Agent
Agent "interleavethinker-2606.13679" from Mtrya/paper-scout, covering abstract, 1 introduction, 2 related works, 2.1 unified image generation and editing model and 2.2 unified multimodal models and interleaved generation.
Agent
Dingyu Yao\, Junhao Zhou\, Chenxu Yang\, Chuanyu Qin\, Haowen Hou\, Zheming Liang, Congcong Wang, Yuhang Cao, Shenglong Ye, Shuai Xie, Shuhuan Gu, Haoyang Huang, Qingyi Si\†, Nan Duan, Jiaqi Wang.
Agent
Jiayi Weng URL: https://trinkle23897.github.io/learning-beyond-gradients/ Artifact repository: https://github.com/Trinkle23897/learning-beyond-gradients.
Agent
Title: Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading.
Agent
Agent "memory-lies-2608.04574" from Mtrya/paper-scout, covering abstract, 1 introduction, 2 related work, 3 study design and 3.1 experimental paradigm and overview.
Agent
Zhenghao Xing 1 \ † Ruiyang Xu 2 \ † Yuxuan Wang 3 \ Jinzheng He 3 Ziyang Ma 2 4 † Qize Yang 3 Yunfei Chu 3 Jin Xu 3 ‡ Junyang Lin 3 Chi-Wing Fu 1 Pheng-Ann Heng 1 ‡.
Agent
Title: OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning.
Agent
Anton Razzhigaev 1,2,3,4 , Andrei Gritsaev 4 , Andrei Kaznacheev 1 , Nikita Dragunov 1 , Roman Yampolskiy 3 , Andrei Kuznetsov 2,4.
Agent
Junyi Zhang 1,∗,† , Jiaxin Ge 1,∗,† , Hanjun Yoo 1,† , Letian Fu 1,‡ , Zihan Yang 2,‡ , Yaowei Liu 2,‡ , Raj Saravanan 1,‡ Shaofeng Yin 2 , Justin Yu 1 , Dantong Niu 1 , Zirui Wang 1 , Roei Herzig 1 , Ken Goldberg 1 , Yutong Bai 1 David M. Chan 1 , Ion Stoica 1 , Angjoo Kanazawa 1 , Jiahui Lei 1,§ , Haiwen Feng 1,2,§…
Agent
Seokju Cho1, Ryo Hachiuma, Abhishek Badki, Hang Su, Byung-Kwan Lee, Chan Hee Song, Sifei Liu, Subhashree Radhakrishnan, Seungryong Kim1, Yu-Chiang Frank Wang and Min-Hung Chen Links: Code · Project Page NVIDIA.
Agent
Yang Zhou 1,2,† , Zixuan Huang 2,3,† , Sunzhu Li 2 , Zhuo Yang 4 , Chen Zhang 1 , Shunian Chen 2,6 , Caijun Yan 1 , Jianyao Xu 2 , Shunyu Liu 5 , Weijie Fu 2 , Peiliang Li 2 , Xiaozhi Chen 2 , Yuxiang Cai 1,∗.
Agent
Xinyu Qiu1,2 Yunzhu Zhang2 Heng Jia1 Shuheng Shen2\ Changhua Meng2 Linchao Zhu1\.
Agent
Haoqin Tu1∗ Jianwen Chen2∗ Zijun Wang1 Siwei Han2 Juncheng Wu1 Hardy Chen1 Haonian Ji2 Kaiwen Xiong2 Jiaqi Liu2 Peng Xia2 Jieru Mei3 Hongliang Fei3 Jason Eshraghian1 Zeyu Zheng4 Yuyin Zhou1 Huaxiu Yao2 Cihang Xie1.