arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2026-01-15 至 2026-01-15 共收录 15
2509.25756 2026-01-15 cs.RO cs.LG

SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential Modeling

SAC Flow: 通过速度重参数化序列建模高效训练基于流的策略

Yixian Zhang, Shu'ang Yu, Tonghe Zhang, Mo Guang, Haojia Hui, Kaiwen Long, Yu Wang, Chao Yu, Wenbo Ding

机构 * Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学) Li Auto(利汽车) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 SAC Flow通过速度重参数化序列建模,高效训练基于流的策略,实现连续控制和机器人操作的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24892 2026-01-15 cs.RO

JuggleRL: Mastering Ball Juggling with a Quadrotor via Deep Reinforcement Learning

JuggleRL: 通过深度强化学习掌握四旋翼机球类抛接

Shilong Ji, Yinuo Chen, Chuqi Wang, Jiayu Chen, Ruize Zhang, Feng Gao, Wenhao Tang, Shu'ang Yu, Sirui Xiang, Xinlei Chen, Chao Yu, Yu Wang

机构 * Tsinghua University(清华大学)

AI总结 JuggleRL通过深度强化学习使四旋翼机实现精准球类抛接,实现实验室与现实环境的高性能击球表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23003 2026-01-15 cs.LG cs.AI cs.SY eess.SY

Physically Plausible Multi-System Trajectory Generation and Symmetry Discovery

物理合理多系统轨迹生成与对称性发现

Jiayin Liu, Yulong Yang, Vineet Bansal, Christine Allen-Blanchette

机构 * Princeton University(普林斯顿大学) Tsinghua University(清华大学)

AI总结 本文提出SPS-GAN,通过辛相空间GAN架构实现多系统轨迹生成与对称性发现,无需先验配置空间知识,通过物理动机项优化实现配置空间的稀疏表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16233 2026-01-15 astro-ph.GA cs.LG

Can AI Dream of Unseen Galaxies? Conditional Diffusion Model for Galaxy Morphology Augmentation

AI能否梦见未见的星系?面向星系形态增强的条件扩散模型

Chenrui Ma, Zechang Sun, Tao Jing, Zheng Cai, Yuan-Sen Ting, Song Huang, Mingyu Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen China(清华大学深圳国际研究生院,清华大学,深圳中国) Department of Strategic and Advanced Interdisciplinary Research, Pengcheng Laboratory, Shenzhen China(战略与先进跨学科研究部,鹏城实验室,深圳中国) Department of Astronomy, Tsinghua University, Beijing China(天文学系,清华大学,北京中国) School of Mathematics and Physics, Qinghai University, Xining China(数学物理学院,青海大学,西宁中国) Department of Astronomy, The Ohio State University, Columbus, OH 43210, USA(天文学系,俄亥俄州立大学,哥伦布,OH 43210,美国) Center for Cosmology and AstroParticle Physics (CCAPP), The Ohio State University, Columbus, OH 43210, USA(宇宙学与天体粒子物理中心(CCAPP),俄亥俄州立大学,哥伦布,OH 43210,美国)

AI总结 本研究提出条件扩散模型GalaxySD,通过合成逼真的星系图像增强ML训练数据,提升标准形态分类性能,并有效提高罕见星系检测的实例数量。

Comments 29 pages, 17 figures, accepted version for ApJS. Comments welcome. See another independent work for further reference, Category-based Galaxy Image Generation via Diffusion Models (Fan, Tang et al.)

Journal ref The Astrophysical Journal Supplement Series, 282, 25 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06821 2026-01-15 cs.CL cs.AI cs.SE

Can LLMs Generate Reliable Test Case Generators? A Study on Competition-Level Programming Problems

LLMs能否生成可靠的测试用例生成器?对竞赛级编程问题的研究

Yuhan Cao, Zian Chen, Kun Quan, Ziliang Zhang, Yu Wang, Xiaoning Dong, Yeqi Feng, Guanzhong He, Jingcheng Huang, Jianhao Li, Yixuan Tan, Jiafu Tang, Yilin Tang, Junlei Wu, Qianyu Xiao, Can Zheng, Shouchen Zhou, Yuxiang Zhu, Yiming Huang, Tianxing He

机构 * Shanghai Qi Zhi Institute(上海启智研究院) ShanghaiTech University(上海科技大学) Wuhan University(武汉大学) Fuzhou University(福州大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) Nanjing University(南京大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学)

AI总结 本文研究LLMs在生成竞赛级编程问题测试用例生成器方面的能力,提出TCGBench基准测试,并通过实验发现LLMs在生成针对性测试用例以暴露代码缺陷方面存在不足。

Comments 37 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19789 2026-01-15 cs.LG

What Can RL Bring to VLA Generalization? An Empirical Study

RL能为VLA泛化带来什么?一项实证研究

Jijia Liu, Feng Gao, Bingwen Wei, Xinlei Chen, Qingmin Liao, Yi Wu, Chao Yu, Yu Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

AI总结 本研究通过实证分析发现,PPO在提升VLA的语义理解和执行鲁棒性方面优于SFT,同时保持视觉鲁棒性,为VLA泛化提供了有效的方法。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11609 2026-01-15 cs.LG

Exploiting Task Relationships in Continual Learning via Transferability-Aware Task Embeddings

通过转移意识的任务嵌入利用任务关系进行持续学习

Yanru Wu, Jianning Wang, Xiangyu Chen, Enming Zhang, Yang Tan, Hanbing Liu, Yang Li

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Shenzhen Key Laboratory of Ubiquitous Data Enabling, SIGS, Tsinghua(深圳 ubiquitous 数据赋能关键实验室,SIGS,清华大学)

AI总结 本文提出H-嵌入和超网络框架,通过转移意识的任务嵌入提升持续学习中任务间关系的利用效果。

Comments 28 pages, 5 figures, accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09260 2026-01-15 cs.AI

Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models

高效路径与密集奖励:用于大语言模型的概率流推理

Yan Liu, Feng Zhang, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Han Liu, Yangdong Deng

机构 * Meituan(美团) Tsinghua University(清华大学) Peking University(北京大学) Dalian University of Technology(大连理工大学)

AI总结 CoT-Flow通过概率流框架提升大语言模型的推理效率与性能,采用流引导解码和流强化学习方法实现信息高效推理路径和密集奖励函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09163 2026-01-15 cs.RO

CEI: A Unified Interface for Cross-Embodiment Visuomotor Policy Learning in 3D Space

CEI:一种用于3D空间跨身体视觉运动策略学习的统一接口

Tong Wu, Shoujie Li, Junhao Gong, Changqing Guo, Xingting Li, Shilong Mu, Wenbo Ding

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 CEI提出了一种跨身体视觉运动策略学习框架,通过功能相似性量化和梯度优化实现不同机械臂和末端执行器间的演示转移,实验显示在模拟和现实任务中均取得高转移效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09136 2026-01-15 cs.CV cs.AI

SkinFlow: Efficient Information Transmission for Open Dermatological Diagnosis via Dynamic Visual Encoding and Staged RL

SkinFlow: 通过动态视觉编码和分阶段强化学习实现开放性皮肤病诊断的高效信息传输

Lijun Liu, Linwei Chen, Zhishou Zhang, Meng Tian, Hengfu Cui, Ruiyang Li, Zhaocheng Liu, Qiang Ju, Qianxi Li, Hong-Yu Zhou

机构 * Baichuan Inc.(百川公司) Department of Dermatology Peking University First Hospital(北京大学第一医院皮肤科) Beijing Key Laboratory of Molecular Diagnosis on Dermatoses(北京分子皮肤病诊断重点实验室) National Clinical Research Center for Skin and Sexually Transmitted Diseases(国家皮肤及性传播疾病临床医学研究中心) NMPA Key Laboratory for Quality Control and Evaluation of Cosmetics(国家药监局化妆品质量控制与评价重点实验室) School of Biomedical Engineering Tsinghua University(清华大学生物医学工程学院) University of Hong Kong(香港大学)

AI总结 SkinFlow通过动态视觉编码和分阶段强化学习提升皮肤病诊断效率,实现比通用模型更优的准确率

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09083 2026-01-15 cs.LG

SRT: Accelerating Reinforcement Learning via Speculative Rollout with Tree-Structured Cache

SRT:通过树结构缓存的推测式回滚加速强化学习

Chi-Chih Chang, Siqi Zhu, Zhichen Zeng, Haibin Lin, Jiaxuan You, Mohamed S. Abdelfattah, Ziheng Jiang, Xuehai Qian

机构 * Cornell University(康奈尔大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) University of Washington(华盛顿大学) ByteDance(字节跳动)

AI总结 SRT通过树结构缓存的推测式回滚方法,有效加速语言模型的在线强化学习,提升生成效率并降低推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11354 2026-01-15 cs.CV

A Multi-Mode Structured Light 3D Imaging System with Multi-Source Information Fusion for Underwater Pipeline Detection

一种基于多源信息融合的多模式结构光3D成像系统用于水下管道检测

Qinghan Hu, Haijiang Zhu, Na Sun, Lei Chen, Zhengqiang Fan, Zhiqing Li

机构 * College of Information Science and Technology, Beijing University of Chemical Technology, Beijing 100029, China(信息科学与技术学院,北京化工大学,中国北京100029) Department of Mechanical Engineering, Tsinghua University, Beijing 100084, China(机械工程系,清华大学,中国北京100084) Guoneng Zhishen Control Technology Co., Ltd., Beijing 102211, China(国能智深控制技术有限公司,中国北京102211) College of Intelligent Science and Engineering, Beijing University of Agriculture, Beijing 102206, China(智能科学与工程学院,北京农业大学,中国北京102206)

AI总结 本文提出了一种基于多源信息融合的多模式结构光3D成像系统,用于水下管道检测,通过改进的校正方法和融合策略提升检测精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23675 2026-01-15 cs.CR cs.AI

QueryIPI: Query-agnostic Indirect Prompt Injection on Coding Agents

QueryIPI: 针对编码代理的查询无关间接提示注入

Yuchong Xie, Zesen Liu, Mingyu Luo, Zhixiang Zhang, Kaikai Zhang, Yuanyuan Yuan, Zongjie Li, Ping Chen, Shuai Wang, Dongdong She

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) Fudan University(复旦大学) Tsinghua University(清华大学)

AI总结 QueryIPI通过利用系统不变性与工具描述,实现对编码代理的查询无关间接提示注入,实验显示其在模拟代理中达到87%的成功率,揭示了现实中的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06803 2026-01-15 cs.CV

DyDiT++: Diffusion Transformers with Timestep and Spatial Dynamics for Efficient Visual Generation

DyDiT++: 带时间步和空间动态的扩散变换器用于高效的视觉生成

Wangbo Zhao, Yizeng Han, Jiasheng Tang, Kai Wang, Hao Luo, Yibing Song, Gao Huang, Fan Wang, Yang You

机构 * National University of Singapore(新加坡国立大学) DAMO Academy, Alibaba Group(阿里云达摩院) Hupan Lab(虎扑实验室) Tsinghua University(清华大学)

AI总结 DyDiT++通过动态调整时间步和空间计算,提升视觉生成效率,减少计算成本并拓展应用范围。

Comments This paper was accepted to the IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI) on January 9, 2026. arXiv admin note: substantial text overlap with arXiv:2410.03456

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04038 2026-01-15 cs.RO cs.SY eess.SY

Autonomous Robotic Bone Micro-Milling System with Automatic Calibration and 3D Surface Fitting

自主机器人骨微铣系统与自动校准及3D表面拟合

Enduo Zhao, Xiaofeng Lin, Yifan Wang, Kanako Harada

机构 * Department of Mechanical Engineering, Graduate School of Engineering, The University of Tokyo(东京大学工学研究生院机械工程系) School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) Center for Disease Biology and Integrative Medicine, Graduate School of Medicine, The University of Tokyo(东京大学医学研究生院疾病生物学与整合医学中心)

AI总结 本研究提出了一种自主机器人骨微铣系统,通过集成微立体相机和CNN关键点检测,实现自动校准和3D表面拟合,显著提升小鼠颅窗创建的自动化水平和精度。

Comments 8 pages, 8 figures, accepted by RA-L. Please refer to the DOI to access the accepted version

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 2, pp. 2250-2257 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏