arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2025-12-16 至 2025-12-16 共收录 19
2506.09476 2025-12-16 cs.CV

WakeupUrban: Unsupervised Semantic Segmentation of Mid-20$^{th}$ century Urban Landscapes with Satellite Imagery

WakeupUrban: 利用卫星图像对20世纪中叶城市景观进行无监督语义分割

Tianxiang Hao, Lixian Zhang, Yingjia Zhang, Mengxuan Chen, Jinxiao Zhang, Runmin Dong, Haohuan Fu

机构 * Tsinghua University, SIGS(清华大学 SIGS) National Supercomputing Center in Shenzhen(深圳国家超算中心) New York University Shanghai(纽约大学上海分校) Tsinghua University, DESS(清华大学 DESS) Sun Yat-sen University(中山大学)

AI总结 WakeupUrban通过无监督语义分割框架WakeupUSM,利用历史卫星图像分析20世纪中叶城市景观,提升长期城市变化的定量研究能力。

Comments 11 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13240 2025-12-16 cs.AI cs.LG

Reflective Preference Optimization (RPO): Enhancing On-Policy Alignment via Hint-Guided Reflection

反射偏好优化(RPO):通过提示引导的反思增强策略对齐

Zihui Zhao, Zechang Li

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Alibaba Group(阿里巴巴集团)

AI总结 RPO通过提示引导的反思增强策略对齐,减少幻觉并提升多模态基准性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13094 2025-12-16 cs.RO cs.AI

Sequence of Expert: Boosting Imitation Planners for Autonomous Driving through Temporal Alternation

专家序列:通过时间交替提升自动驾驶的模仿规划器

Xiang Li, Gang Liu, Weitao Zhou, Hongyi Zhu, Zhong Cao

机构 * HighTech Lab, Tsinghua University(清华大学高科技实验室) School of Mobility, Tsinghua University(清华大学移动学院) University of Michigan(密歇根大学)

AI总结 专家序列通过时间交替策略提升自动驾驶模仿规划器的闭环性能,显著改进了模型表现和训练效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13012 2025-12-16 cs.SD

HQ-MPSD: A Multilingual Artifact-Controlled Benchmark for Partial Deepfake Speech Detection

HQ-MPSD:一种多语言可控的部分深度伪造语音检测基准

Menglu Li, Majd Alber, Ramtin Asgarianamiri, Lian Zhao, Xiao-Ping Zhang

机构 * Shenzhen Key Laboratory of Ubiquitous Data Enabling(ubiquitous 数据赋能深圳实验室) Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Tsinghua University(清华大学)

AI总结 HQ-MPSD是一个高质量多语言数据集,用于评估部分深度伪造语音检测的挑战与性能

Comments 6 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13006 2025-12-16 cs.CV

Few-Step Distillation for Text-to-Image Generation: A Practical Guide

文本到图像生成的少步蒸馏:一份实用指南

Yifan Pu, Yizeng Han, Zhiwei Tang, Jiasheng Tang, Fan Wang, Bohan Zhuang, Gao Huang

机构 * Tsinghua University(清华大学) DAMO Academy, Alibaba Group(阿里达摩院) Hupan Lab(华研实验室) Zhejiang University(浙江大学)

AI总结 本文提出了一种少步蒸馏方法,用于文本到图像生成,通过比较先进技术并提供实用指南,以提高生成质量和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12706 2025-12-16 cs.AI cs.SE

Synergizing Code Coverage and Gameplay Intent: Coverage-Aware Game Playtesting with LLM-Guided Reinforcement Learning

协同代码覆盖率与游戏意图:基于LLM引导强化学习的覆盖感知游戏测试

Enhong Mu, Minami Yoda, Yan Zhang, Mingyue Zhang, Yutaka Matsuno, Jialong Li

机构 * College of Computer and Information Science, Southwest University(西南大学计算机与信息科学学院) College of Science and Technology, Nihon University(日本立命馆大学科学技术学院) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Waseda Institute for Advanced Study, Waseda University(早稻田大学高级研究机构)

AI总结 SMART框架通过LLM引导强化学习,结合结构验证与功能验证,提升游戏更新测试的覆盖率和任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12658 2025-12-16 cs.CV

CogDoc: Towards Unified thinking in Documents

CogDoc: 向文档中的统一思维迈进

Qixin Xu, Haozhe Wang, Che Liu, Fangzhen Lin, Wenhu Chen

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学) University of Waterloo(滑铁卢大学) Imperial College London(伦敦帝国学院)

AI总结 CogDoc提出一种统一的粗到细思维框架,通过直接强化学习提升文档推理性能,优于现有方法并在视觉丰富任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12604 2025-12-16 cs.CV

No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching

无空闲缓存:通过极端瘦身缓存加速扩散模型

Tingyan Wen, Haoyu Li, Yihuang Chen, Xing Zhou, Lifei Zhu, Xueqian Wang

机构 * Tsinghua University(清华大学) Central Media Technology Institute, Huawei(华为中央媒体技术研究所)

AI总结 X-Slim通过双阈值缓存策略,高效利用时间步、块和令牌层面的冗余,实现扩散模型加速,减少延迟并提升生成质量。

Comments Project page: https://thu-accdiff.github.io/xslim-page/ Code: https://github.com/THU-AccDiff/xslim

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12578 2025-12-16 quant-ph cs.CC cs.LG

Scalable Quantum Error Mitigation with Neighbor-Informed Learning

可扩展的邻域感知学习量子误差缓解

Zhenyu Chen, Bin Cheng, Minbo Gao, Xiaodie Lin, Ruiqi Zhang, Zhaohui Wei, Zhengfeng Ji

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Centre for Quantum Technologies, National University of Singapore(新加坡国立大学量子技术中心) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) Yau Mathematical Sciences Center, Tsinghua University(清华大学姚期 Banking 数学科学中心) Department of Mathematics, Tsinghua University(清华大学数学系) Yanqi Lake Beijing Institute of Mathematical Sciences and Applications(燕琦湖北京数学科学与应用研究院)

AI总结 本文提出邻域感知学习框架,通过灵活高效的训练方法提升量子误差缓解的性能,实现理论与实际的双重优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12560 2025-12-16 cs.CV cs.AI

StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding

StreamingAssistant: 为加速在线视频理解的高效视觉标记修剪

Xinqi Jin, Hanxun Yu, Bohan Yu, Kebin Liu, Jian Liu, Keda Tao, Yixuan Pei, Huan Wang, Fan Dang, Jiangchuan Liu, Weiqiang Wang

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Westlake University(西湖大学) Beijing Jiaotong University(北京交通大学) Simon Fraser University(西蒙弗雷泽大学)

AI总结 StreamingAssistant通过高效视觉标记修剪技术,提升在线视频理解的准确性和效率,减少GPU内存使用和计算延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12272 2025-12-16 q-bio.QM cs.AI

Accurate de novo sequencing of the modified proteome with OmniNovo

利用OmniNovo实现修饰蛋白质组的准确从头测序

Yuhan Chen, Shang Qu, Zhiqiang Gao, Yuejin Yang, Xiang Zhang, Sheng Xu, Xinjie Mao, Liujia Qian, Jiaqi Wei, Zijie Qiu, Chenyu You, Lei Bai, Ning Ding, Tiannan Guo, Bowen Zhou, Siqi Sun

机构 * Shanghai Research Institute for Intelligent Autonomous Systems(上海智能自主系统研究所) Tongji University(同济大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of Electronic Engineering(电子工程系) Tsinghua University(清华大学) Research Institute of lntelligent Complex Systems(智能复杂系统研究所) Fudan University(复旦大学) University of British Columbia(不列颠哥伦比亚大学) School of Medicine(医学院) Westlake University(西湖大学) Shanghai Innovation Institute(上海创新研究院) Zhejiang University(浙江大学) Stony Brook University(石溪大学)

AI总结 OmniNovo通过统一深度学习框架实现对修饰蛋白质组的高精度从头测序,识别更多肽并提高假发现率控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16931 2025-12-16 cs.CY cs.CE cs.CL

OmniScientist: Toward a Co-evolving Ecosystem of Human and AI Scientists

OmniScientist:迈向人类与AI科学家共进的生态系统

Chenyang Shao, Dehao Huang, Yu Li, Keyu Zhao, Weiquan Lin, Yining Zhang, Qingbin Zeng, Zhiyu Chen, Tianxing Li, Yifei Huang, Taozhong Wu, Xinyang Liu, Ruotong Zhao, Mengsheng Zhao, Jiaoyang Li, Xuhua Zhang, Yue Wang, Yuanyi Zhen, Fengli Xu, Yong Li, Tie-Yan Liu

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,BNRist,清华大学) Zhongguancun Academy(中关村学院)

AI总结 OmniScientist通过模拟人类科学系统,实现AI与人类科学家的协作与共进化,构建可持续的创新生态系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11187 2025-12-16 cs.CV

FastVID: Dynamic Density Pruning for Fast Video Large Language Models

FastVID: 动态密度修剪用于快速视频大语言模型

Leqi Shen, Guoqiang Gong, Tao He, Yifeng Zhang, Pengzhang Liu, Sicheng Zhao, Guiguang Ding

机构 * School of Software, Tsinghua University(清华大学软件学院) BNRist, Tsinghua University(清华大学BNRist) GRG Banking Equipment Co., Ltd.(GRG银行设备有限公司)

AI总结 FastVID通过动态密度修剪技术,显著降低视频大语言模型的计算开销,同时保持高准确性,实现高效的视频处理性能。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11614 2025-12-16 quant-ph cs.LG math.ST stat.TH

On the physics of nested Markov models: a generalized probabilistic theory perspective

关于嵌套马尔可夫模型的物理:从广义概率理论视角出发

Xingjian Zhang, Yuhao Wang, Elie Wolfe

机构 * QICI Quantum Information and Computation Initiative, School of Computing and Data Science, The University of Hong Kong, Hong Kong SAR, China(量子信息与计算倡议,计算与数据科学学院,香港大学,香港特别行政区,中国) Institute for Interdisciplinary Information Sciences, Tsinghua University, Beijing, China(交叉信息科学研究所,清华大学,北京,中国) Shanghai Qi Zhi Institute, Shanghai, China(上海启智研究所,上海,中国) Perimeter Institute for Theoretical Physics, Waterloo, Ontario, Canada(理论物理研究所,滑铁卢,安大略,加拿大)

AI总结 本文从广义概率理论视角探讨嵌套马尔可夫模型,揭示其与物理实现之间的差距,并展示新的GPT不可侵犯约束。

Comments V2: 21 pages, 9 figures, 1 table; simpler proofs for the original theorems provided; new causal models introduced and discussed; one author added. Comments are welcome!

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21600 2025-12-16 eess.IV cs.AI cs.CV eess.SP physics.med-ph

Robust Simultaneous Multislice MRI Reconstruction Using Slice-Wise Learned Generative Diffusion Priors

基于切片学习生成扩散先验的鲁棒同时多切片MRI重建

Shoujin Huang, Guanxiong Luo, Yunlin Zhao, Yilong Liu, Yuwan Wang, Kexin Yang, Jingzhe Liu, Hua Guo, Min Wang, Lingyan Zhang, Mengye Lyu

机构 * College of Health Science and Environmental Engineering, Shenzhen Technology University(深圳科技大学健康科学与环境工程学院) University Medical Center Göttingen(哥廷根大学医学中心) Guangdong-Hongkong-Macau CNS Regeneration Institute, Key Laboratory of CNS Regeneration (Jinan University)-Ministry of Education, Jinan University(广东-港澳-澳门神经科学再生研究所,神经科学再生重点实验室(暨南大学)-教育部,暨南大学) Department of Radiology, The First Hospital of Tsinghua University(清华大学第一医院放射科) Center for Biomedical Imaging Research, Department of Biomedical Engineering, School of Medicine, Tsinghua University(清华大学生物医学成像研究中心,生物医学工程系,医学院) Key Laboratory for Biomedical Engineering of Ministry of Education, College of Biomedical Engineering and Instrument Science, Zhejiang University(教育部生物医学工程重点实验室,生物医学工程与仪器科学学院,浙江大学) Department of Endocrinology and Metabolism, Sir Run Run Shaw Hospital, Zhejiang University School of Medicine(浙江大学医学院邵逸夫医院内分泌科) Lab of Molecular Imaging and Medical Intelligence, Department of Radiology, Longgang Central Hospital of Shenzhen (Shenzhen Clinical Medical College, Guangzhou University of Chinese Medicine(分子成像与医学智能实验室,放射科,深圳龙岗中心医院(深圳临床医学院,广州中医药大学;龙岗临床学院,汕头大学医学院)) Longgang Clinical Institute of Shantou University Medical College)

AI总结 ROGER通过深度生成先验和低频增强模块,实现鲁棒的同时多切片MRI重建,提升解剖和功能成像质量。

Journal ref Published in Medical Image Analysis, Volume 108, 2026, 103851

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12051 2025-12-16 q-bio.GN cs.AI cs.LG

Dy-mer: An Explainable DNA Sequence Representation Scheme using Dictionary Learning

Dy-mer: 一种基于字典学习的可解释DNA序列表示方案

Zhiyuan Peng, Naifan Zhang, Yuanbo Tang, Yang Li

机构 * Shenzhen Key Laboratory of Ubiquitous Data Enabling(深圳 ubiquitous 数据赋能重点实验室) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 Dy-mer通过字典学习方法,提供了一种可解释且稳健的DNA序列表示方案,实现了在DNA启动子分类和motif检测等任务中的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20336 2025-12-16 cs.CV cs.SD eess.AS

RapVerse: Coherent Vocals and Whole-Body Motions Generations from Text

RapVerse: 从文本歌词生成连贯的唱声与全身动作

Jiaben Chen, Xin Yan, Yihang Chen, Siyuan Cen, Zixin Wang, Qinwei Ma, Haoyu Zhen, Kaizhi Qian, Lie Lu, Chuang Gan

机构 * UMass Amherst(马萨诸塞大学阿默斯特分校) Wuhan University(武汉大学) UC San Diego(加州大学圣地亚哥分校) Tsinghua University(清华大学) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) Dolby Laboratories(杜比实验室)

AI总结 RapVerse通过统一生成框架,从文本歌词生成连贯唱声与全身动作,实现多模态统一建模,提升生成效果与基准性能。

Comments ICCV 2025, Project website: https://jiabenchen.github.io/RapVerse/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11846 2025-12-16 cs.LG stat.ML

Exploring Topological Bias in Heterogeneous Graph Neural Networks

探索异构图神经网络中的拓扑偏差

Yihan Zhang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 本文研究了异构图神经网络中的拓扑偏差问题,提出了一种基于节点映射值差异的去偏结构,通过对比学习提升HGNN性能。

Journal ref ECAI 2025, pp. 2937-2944 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16020 2025-12-16 cs.CV cs.AI

Physically Realistic Sequence-Level Adversarial Clothing for Robust Human-Detection Evasion

物理真实序列级对抗性服装用于鲁棒的人体检测规避

Dingkun Zhou, Patrick P. K. Chan, Hengxu Wu, Shikang Zheng, Ruiqi Huang, Yuanjie Zhao

机构 * School of Future Technology, South China University of Technology(未来技术学院,华南理工大学) Institute for Interdisciplinary Information Sciences, Tsinghua University(交叉信息研究院,清华大学)

AI总结 本研究提出序列级优化框架,生成可打印的对抗性服装纹理,以实现在数字和物理环境中对人类检测的鲁棒规避。

详情

展开后加载摘要…

URL PDF HTML 收藏