arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Southern California(南加州大学)

2025-11-11 至 2025-11-11 共收录 7
2511.07416 2025-11-11 cs.RO cs.AI cs.CV

Robot Learning from a Physical World Model

Jiageng Mao, Sicheng He, Hao-Ning Wu, Yang You, Shuyang Sun, Zhicheng Wang, Yanan Bao, Huizhong Chen, Leonidas Guibas, Vitor Guizilini, Howard Zhou, Yue Wang

机构 * Google DeepMind(谷歌DeepMind) USC(美国斯克利普斯大学) Stanford(斯坦福大学) Toyota Research Institute(丰田研究机构)

Comments Project page: https://pointscoder.github.io/PhysWorld_Web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07343 2025-11-11 cs.LG cs.AI

TNT: Improving Chunkwise Training for Test-Time Memorization

Zeman Li, Ali Behrouz, Yuan Deng, Peilin Zhong, Praneeth Kacham, Mahdi Karami, Meisam Razaviyayn, Vahab Mirrokni

机构 * University of Southern California(南加州大学) Google Research(谷歌研究)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06913 2025-11-11 cs.LG cs.AI

Sampling and Loss Weights in Multi-Domain Training

Mahdi Salmani, Pratik Worah, Meisam Razaviyayn, Vahab Mirrokni

机构 * University of Southern California(南加州大学) Google Research(谷歌研究)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11002 2025-11-11 cs.LG cs.DC

pMixFed: Efficient Personalized Federated Learning through Adaptive Layer-Wise Mixup

Yasaman Saadati, Mohammad Rostami, M. Hadi Amini

机构 * Florida International University(佛罗里达国际大学) USC Information Sciences Institute(南加州大学信息科学研究所)

Comments 45 pages, 10 Images

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06134 2025-11-11 cs.AI cs.MA

Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs

Wei Yang, Jiacheng Pang, Shixuan Li, Paul Bogdan, Stephen Tu, Jesse Thomason

机构 * University of Southern California(南加州大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05684 2025-11-11 cs.IR cs.CL

A Representation Sharpening Framework for Zero Shot Dense Retrieval

Dhananjay Ashok, Suraj Nair, Mutasem Al-Darabsah, Choon Hui Teo, Tarun Agarwal, Jonathan May

机构 * Information Sciences Institute, University of Southern California(信息科学研究所,南加州大学) Amazon(亚马逊)

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03464 2025-11-11 cs.GT cs.LG math.OC

From Average-Iterate to Last-Iterate Convergence in Games: A Reduction and Its Applications

Yang Cai, Haipeng Luo, Chen-Yu Wei, Weiqiang Zheng

机构 * Yale University(耶鲁大学) University of Southern California(南加州大学) University of Virginia(弗吉尼亚大学)

Comments NeurIPS 2025. 24 pages. Updated version with more discussions and robustness in the bandit feedback setting

详情

展开后加载摘要…

URL PDF HTML 收藏