arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2026-01-26 至 2026-01-26 共收录 13
2601.16764 2026-01-26 eess.SY cs.LG cs.SY math.OC

ReLU Networks for Model Predictive Control: Network Complexity and Performance Guarantees

ReLU网络用于模型预测控制:网络复杂度与性能保证

Xingchen Li, Keyou You

机构 * Department of Automation, and Beijing National Research Center for Info. Sci. & Tech. (BNRist), Tsinghua University, Beijing 100084, China(自动化系,北京信息科学与技术国家研究中心(BNRist),清华大学,北京)

AI总结 本文提出基于投影的方法,建立状态依赖的Lipschitz连续性属性,并推导ReLU网络宽度和深度的显式界限,以保证MPC策略的闭环性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16547 2026-01-26 cs.SD cs.AI eess.AS

CORD: Bridging the Audio-Text Reasoning Gap via Weighted On-policy Cross-modal Distillation

CORD:通过加权在线跨模态蒸馏弥合音频-文本推理差距

Jing Hu, Danxiang Zhu, Xianlong Luo, Dan Zhang, Shuwei He, Yishu Lei, Haitao Zheng, Shikun Feng, Jingzhou He, Yu Sun, Hua Wu, Haifeng Wang

机构 * ERNIE Team, Baidu(百度ERNIE团队) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) College of Computer Science, Inner Mongolia University(内蒙古大学计算机学院)

AI总结 CORD通过加权在线跨模态蒸馏方法,有效弥合音频与文本推理之间的差距,提升音频条件推理能力。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16520 2026-01-26 cs.CV cs.AI cs.CL

TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning

TangramPuzzle: 通过组合空间推理评估多模态大语言模型

Daixian Liu, Jiayi Kuang, Yinghui Li, Yangning Li, Di Yin, Haoyu Cao, Xing Sun, Ying Shen, Hai-Tao Zheng, Liang Lin, Philip S. Yu

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室) University of Illinois Chicago(伊利诺伊大学香槟分校)

AI总结 TangramPuzzle通过几何基准测试评估多模态大语言模型的组合空间推理能力,发现模型在匹配轮廓时忽视几何约束,导致碎片变形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16506 2026-01-26 cs.CR cs.AI

SafeThinker: Reasoning about Risk to Deepen Safety Beyond Shallow Alignment

SafeThinker: 通过风险推理深化安全对齐

Xianya Fang, Xianying Luo, Yadong Wang, Xiang Chen, Yu Tian, Zequn Sun, Rui Liu, Jun Fang, Naiqiang Tan, Yuanning Cui, Sheng-Jun Huang

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Didi International Business Group(滴滴国际商务集团) Institute for AI, Tsinghua University(清华大学人工智能研究院) Nanjing University of Information Science & Technology(南京信息科学技术大学)

AI总结 SafeThinker通过动态分配防御资源,有效提升模型对伪装攻击的防御能力,同时保持实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16489 2026-01-26 cs.SE cs.AI cs.CL

EvoConfig: Self-Evolving Multi-Agent Systems for Efficient Autonomous Environment Configuration

EvoConfig:用于高效自主环境配置的自演化多智能体系统

Xinshuai Guo, Jiayi Kuang, Linyue Pan, Yinghui Li, Yangning Li, Hai-Tao Zheng, Ying Shen, Di Yin, Xing Sun

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 EvoConfig通过自演化多智能体系统提升自主环境配置效率,实现更高成功率和更强调试能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16429 2026-01-26 cs.CV cs.AI

AlphaFace: High Fidelity and Real-time Face Swapper Robust to Facial Pose

AlphaFace: 高保真和实时的面部交换器,对面部姿态具有鲁棒性

Jongmin Yu, Hyeontaek Oh, Zhongtian Sun, Angelica I Aviles-Rivero, Moongu Jeon, Jinhong Yang

机构 * University of Cambridge(剑桥大学) University of Kent(肯特大学) Tsinghua University(清华大学) Gwangju Institute of Science and Technology(全州科学技术院) Inje University(庆北大学)

AI总结 AlphaFace通过结合视觉-语言模型和CLIP嵌入,实现高保真和实时的面部交换,提升对极端面部姿态的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16035 2026-01-26 cs.RO

Collision-Free Humanoid Traversal in Cluttered Indoor Scenes

无碰撞的人形机器人在杂乱室内场景中的移动

Han Xue, Sikai Liang, Zhikai Zhang, Zicheng Zeng, Yun Liu, Yunrui Lian, Jilong Wang, Qingtao Liu, Xuesong Shi, Li Yi

机构 * Tsinghua University(清华大学) Tongji University(同济大学) Galbot Shanghai Qi Zhi Institute(上海启智研究院) South China University of Technology(华南理工大学) Peking University(北京大学) Zhejiang University(浙江大学)

AI总结 提出HumanoidPF势场方法,通过混合场景生成实现人形机器人在杂乱室内场景中的无碰撞移动,有效提升强化学习的训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13976 2026-01-26 cs.CV cs.RO

FantasyVLN: Unified Multimodal Chain-of-Thought Reasoning for Vision-Language Navigation

FantasyVLN: 一种统一的多模态链式推理框架用于视觉-语言导航

Jing Zuo, Lingzhou Mu, Fan Jiang, Chengcheng Ma, Mu Xu, Yonggang Qi

机构 * Fantasy AIGC Team(幻想AIGC团队) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

AI总结 FantasyVLN通过统一的隐式推理框架实现视觉-语言导航的实时高效推理,结合多模态信息提升导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12856 2026-01-26 cs.AI cs.LG

Mining Citywide Dengue Spread Patterns in Singapore Through Hotspot Dynamics from Open Web Data

通过开放网络数据挖掘新加坡城市登革热传播模式的热点动态

Liping Huang, Gaoxi Xiao, Stefan Ma, Hechang Chen, Shisong Tang, Flora Salim

机构 * Agency for Science, Technology and Research (A*STAR)(科技研究局) Nanyang Technological University(南洋理工大学) Jilin University(吉林大学) Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

AI总结 通过开放网络数据挖掘新加坡登革热传播模式,利用热点动态预测和验证传播动态,提升公共卫生规划与城市韧性。

Comments 9 pages, 9 figures. It's accepted by WWW 2026 Web4Good Track. To make accessible earlier, authors would like to put it on arxiv before the conference

Journal ref WWW 2026, i.e., The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10492 2026-01-26 cs.LG cs.AI

UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning

UACER:一种用于鲁棒对抗强化学习的不确定性自适应批评者集合框架

Jiaxi Wu, Tiantian Zhang, Yuxing Wang, Yongzhe Chang, Xueqian Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 UACER通过多样化批评者集合和时间变化衰减不确定性机制,提升鲁棒对抗强化学习的稳定性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12176 2026-01-26 quant-ph cs.AI

Reinforcement Learning for Charging Optimization of Inhomogeneous Dicke Quantum Batteries

强化学习用于不均匀迪克量子电池的充电优化

Xiaobin Song, Siyuan Bai, Da-Wei Wang, Hanxiao Tao, Xizhe Wang, Rebing Wu, Benben Jiang

机构 * CFINS, Department of Automation, Beijing National Research Center for Information Science and Technology, Tsinghua University, Beijing, 100084, China(信息科学与技术北京国家研究中心,自动化系,清华大学,北京,100084,中国) School of Integrated Circuits, Tsinghua University, Beijing, 100084, China(集成电路学院,清华大学,北京,100084,中国)

AI总结 本文通过强化学习优化不均匀迪克量子电池的充电策略,在部分可观测条件下利用二阶相关性提升充电效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.05092 2026-01-26 cs.LG

Task Aware Dreamer for Task Generalization in Reinforcement Learning

面向任务泛化的任务感知梦者

Chengyang Ying, Xinning Zhou, Zhongkai Hao, Hang Su, Songming Liu, Dong Yan, Jun Zhu

机构 * Department of Computer Science and Technology(计算机科学与技术系) Beijing National Research Center for Information Science and Technology(北京信息科学国家研究中心) Tsinghua-Bosch Joint Center for Machine Learning, Institute for Artificial Intelligence(清华大学-博世联合机器学习中心,人工智能研究院) Tsinghua University(清华大学)

AI总结 本文提出任务感知梦者(TAD)方法,通过整合奖励引导的特征提升强化学习中任务泛化能力,尤其在高任务分布相关性任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.15635 2026-01-26 cs.LG cs.IR

Vertical Semi-Federated Learning for Efficient Online Advertising

垂直半联邦学习用于高效在线广告

Wenjie Li, Shu-Tao Xia, Jiangke Fan, Teng Zhang, Xingxing Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文提出垂直半联邦学习方法,通过联合特权学习框架解决传统垂直联邦学习在适用范围和实时服务中的局限,提升在线广告系统的效率和效果。

Comments TheWebConf 2026 short (proceedings). An earlier version was presented at the FL workshop of IJCAI 2023 (non-proceedings)

详情

展开后加载摘要…

URL PDF HTML 收藏