arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2025-12-18 至 2025-12-18 共收录 10
2512.04770 2025-12-18 cs.RO cs.AI cs.ET cs.SY eess.SY

Embodied Co-Design for Rapidly Evolving Agents: Taxonomy, Frontiers, and Challenges

具身共设计用于快速演化的智能体:分类、前沿与挑战

Yuxing Wang, Zhiyu Chen, Tiantian Zhang, Qiyue Yin, Yongzhe Chang, Zhiheng Li, Liang Wang, Xueqian Wang

机构 * Shenzhen International Graduate School (SIGS), Tsinghua University(深圳国际研究生院(SIGS),清华大学) New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(模式识别新实验室(NLPR),自动化研究所,中国科学院)

AI总结 本文系统回顾了具身共设计的最新进展,提出分层分类法并分析了其在智能体设计中的应用与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20764 2025-12-18 cs.CL

Feel the Difference? A Comparative Analysis of Emotional Arcs in Real and LLM-Generated CBT Sessions

感知差异?真实与LLM生成CBT对话中情感弧的比较分析

Xiaoyi Wang, Jiwei Zhang, Guangtao Zhang, Honglei Guo

机构 * Department of Computer Science, Shantou University(汕头大学计算机科学系) Department of Automation, Tsinghua University(清华大学自动化系) BNRIST, Tsinghua University(清华大学脑科学与类脑智能研究院)

AI总结 本研究通过比较真实与LLM生成的CBT对话,揭示了合成对话在情感动态上的不足,强调了情感真实性的关键作用。

Comments Accepted at 2025 EMNLP findings,19 page,2 figures

Journal ref In Findings of the Association for Computational Linguistics: EMNLP 2025, pages 19999-20017

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09245 2025-12-18 cs.CV

DriveMLM: Aligning Multi-Modal Large Language Models with Behavioral Planning States for Autonomous Driving

DriveMLM: 通过行为规划状态对齐多模态大语言模型以实现自动驾驶

Erfei Cui, Wenhai Wang, Zhiqi Li, Jiangwei Xie, Haoming Zou, Hanming Deng, Gen Luo, Lewei Lu, Xizhou Zhu, Jifeng Dai

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

AI总结 DriveMLM通过多模态大语言模型对齐行为规划状态,提升自动驾驶系统的决策能力与闭环性能。

Comments Accepted to Visual Intelligence

Journal ref Visual Intelligence, Volume 3, article number 22, (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15176 2025-12-18 cs.LG cs.AI

DEER: Draft with Diffusion, Verify with Autoregressive Models

DEER:通过扩散模型草稿,通过自回归模型验证

Zicong Cheng, Guo-Wei Yang, Jia Li, Zhijie Deng, Meng-Hao Guo, Shi-Min Hu

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 DEER通过扩散模型草稿和自回归模型验证,实现高效推测解码,大幅提升解码速度和草稿长度。

Comments Homepage : https://czc726.github.io/DEER/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15120 2025-12-18 cs.LG cs.AI

Automatic Reward Shaping from Multi-Objective Human Heuristics

多目标人类启发式自动奖励塑造

Yuqing Xie, Jiayu Chen, Wenhao Tang, Ya Zhang, Chao Yu, Yu Wang

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 MORSE通过双层优化框架自动整合多目标人类启发式奖励,提升机器人任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15069 2025-12-18 cs.CV cs.AI

PMMD: A pose-guided multi-view multi-modal diffusion for person generation

PMMD: 一种基于姿态的多视角多模态扩散用于人物生成

Ziyu Shang, Haoran Liu, Rongchao Zhang, Zhiqian Wei, Tongtong Feng

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) City University of Hong Kong, Hong Kong, China(香港城市大学) Peking University, Beijing, China(北京大学) Tsinghua University, Beijing, China(清华大学)

AI总结 PMMD通过多视角多模态扩散框架,实现可控姿态和外观的人像生成,提升一致性、细节保留和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17346 2025-12-18 cs.LG

Taming Latency and Bandwidth: A Theoretical Framework and Adaptive Algorithm for Communication-Constrained Training

驯服延迟与带宽:一种用于通信受限训练的理论框架和自适应算法

Rongwei Lu, Jingyan Jiang, Chunyang Li, Xingguang Wei, Zhi Wang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Tsinghua University(清华大学) Shenzhen Technology University(深圳科技大学) University of Science and Technology of China(中国科学技术大学)

AI总结 DeCo-SGD通过动态调整压缩比率和陈旧性,解决了通信受限训练中的延迟与带宽问题,提升了分布式训练效率。

Comments This work has been submitted to the IEEE for possible publication. This is an extended version including the complete appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22943 2025-12-18 cs.RO cs.CV

Event Camera Meets Mobile Embodied Perception: Abstraction, Algorithm, Acceleration, Application

事件相机与移动具身感知:抽象、算法、加速与应用

Haoyang Wang, Ruishan Guo, Pengtao Ma, Ciyu Ruan, Xinyu Luo, Wenhua Ding, Tianyang Zhong, Jingao Xu, Yunhao Liu, Xinlei Chen

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The University of Hong Kong(香港大学) Global Innovation Exchange, Tsinghua University(清华大学全球创新交换)

AI总结 本文综述了基于事件的移动传感技术,涵盖其原理、抽象方法、算法进展及加速策略,并探讨了其在视觉里程计、目标跟踪等应用中的挑战与未来发展方向。

Comments Accepted by ACM CSUR,35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20375 2025-12-18 cs.LG stat.ML

Scalable Bayesian Optimization via Focalized Sparse Gaussian Processes

通过聚焦稀疏高斯过程实现可扩展的贝叶斯优化

Yunyue Wei, Vincent Zhuang, Saraswati Soedarmadji, Yanan Sui

机构 * Tsinghua University(清华大学) Google DeepMind(谷歌DeepMind)

AI总结 本文提出聚焦GP和FocalBO方法,通过稀疏高斯过程提升贝叶斯优化效率,实现对高维问题的高效优化。

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05005 2025-12-18 cs.CV cs.LG cs.RO

Diff-2-in-1: Bridging Generation and Dense Perception with Diffusion Models

Diff-2-in-1:通过扩散模型弥合生成与密集感知的鸿沟

Shuhong Zheng, Zhipeng Bao, Ruoyu Zhao, Martial Hebert, Yu-Xiong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Carnegie Mellon University(卡内基梅隆大学) Tsinghua University(清华大学)

AI总结 Diff-2-in-1通过结合扩散模型的生成与感知能力,实现多模态数据生成与密集视觉感知的统一框架,提升视觉感知的判别能力。

Comments 26 pages, 14 figures

Journal ref ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏