arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2025-11-25 至 2025-11-25 共收录 25
2511.19267 2025-11-25 cs.LG

Leveraging Spatiotemporal Graph Neural Networks for Multi-Store Sales Forecasting

利用时空图神经网络进行多门店销售预测

Manish Singh, Arpita Dayama

机构 * Department of Chemical Engineering, IIT Bombay(印度博亚理工大学化学工程系) Rajiv Gandhi University(拉吉夫·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室)

AI总结 本文提出STGNN模型,通过学习自适应图结构提升多门店销售预测精度,优于传统基线方法。

Comments 6 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19168 2025-11-25 cs.LG cs.CL

RAVEN++: Pinpointing Fine-Grained Violations in Advertisement Videos with Active Reinforcement Reasoning

RAVEN++: 通过主动强化推理精准定位广告视频中的细粒度违规

Deyi Ji, Yuekui Yang, Liqun Liu, Peng Shu, Haiyang Wu, Shaogang Tang, Xudong Chen, Shaoping Ma, Tianrun Chen, Lanyun Zhu

机构 * Tencent(腾讯) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

AI总结 RAVEN++通过主动强化推理提升广告视频中细粒度违规检测的精度与泛化能力

Comments EMNLP 2025 (Oral, Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18865 2025-11-25 cs.CV

DualGazeNet: A Biologically Inspired Dual-Gaze Query Network for Salient Object Detection

DualGazeNet: 一种生物启发的双目注视查询网络用于显著物体检测

Yu Zhang, Haoan Ping, Yuchen Li, Zhenshan Bing, Fuchun Sun, Alois Knoll

机构 * School of Computation, Information and Technology, Technical University of Munich(计算信息与技术学院,慕尼黑技术大学) Department of Informatics, Technical University of Munich(信息学院,慕尼黑技术大学) University Research and Innovation Center, Obuda University(奥布达大学研究与创新中心) State Key Laboratory for Novel Software Technology, Nanjing University Suzhou Campus(新型软件技术国家重点实验室,南京大学苏州校区) School of Science and Technology, Nanjing University Suzhou Campus(科学与技术学院,南京大学苏州校区) Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学)

AI总结 DualGazeNet通过生物启发的纯Transformer框架,实现了显著物体检测的高效准确性和计算效率,超越了多种现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18857 2025-11-25 cs.RO

AutoOdom: Learning Auto-regressive Proprioceptive Odometry for Legged Locomotion

AutoOdom: 为腿足运动学习自回归本体里程计

Changsheng Luo, Yushi Wang, Wenhan Cai, Mingguo Zhao

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Booster Robotics(Booster机器人)

AI总结 AutoOdom通过自回归训练方法,有效解决腿足运动中本体里程计的仿真到现实转移问题,显著提升导航精度和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18840 2025-11-25 cs.MA cs.AI

Addressing Situated Teaching Needs: A Multi-Agent Framework for Automated Slide Adaptation

应对情境教学需求:一种多智能体框架用于自动幻灯片适应

Binglin Liu, Yucheng Wang, Zheyuan Zhang, Jiyuan Lu, Shen Yang, Daniel Zhang-Li, Huiqin Liu, Jifan Yu

机构 * Tsinghua University, Beijing, China(清华大学,北京,中国)

AI总结 本文提出一种多智能体框架,用于自动化教学幻灯片适应,通过教师访谈识别关键摩擦点,并在8门课程中验证了其有效性,达到0.89的F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18834 2025-11-25 cs.CV cs.AI

FlowSteer: Guiding Few-Step Image Synthesis with Authentic Trajectories

FlowSteer: 通过真实轨迹引导少步图像合成

Lei Ke, Hubery Yin, Gongye Liu, Zhengyao Lv, Jingcai Guo, Chen Li, Wenhan Luo, Yujiu Yang, Jing Lyu

机构 * Tsinghua University(清华大学) WeChat Vision, Tencent Inc.(腾讯公司微信视觉部门) The Hong Kong University of Science and Technology(香港科学与技术大学) The University of Hong Kong(香港大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 FlowSteer通过引导学生沿教师真实生成轨迹提升ReFlow蒸馏效果,解决分布不匹配和优化调度器问题,提升少步图像合成质量。

Comments Few-Step Image Synthesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18824 2025-11-25 cs.CV cs.CL

Assessing the alignment between infants' visual and linguistic experience using multimodal language models

利用多模态语言模型评估婴儿的视觉和语言经验一致性

Alvin Wei Ming Tan, Jane Yang, Tarun Sepuri, Khai Loong Aw, Robert Z. Sparks, Zi Yin, Virginia A. Marchman, Michael C. Frank, Bria Long

机构 * Department of Psychology, Stanford University(心理学系,斯坦福大学) Department of Psychology, University of California, San Diego(心理学系,加州大学圣地亚哥分校) Department of Psychology, Tsinghua University(心理学系,清华大学)

AI总结 基于多模态语言模型评估婴儿视觉与语言经验一致性,揭示日常学习中视觉与语言对齐的稀有性及跨儿童差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18743 2025-11-25 cs.CL cs.AI

RhinoInsight: Improving Deep Research through Control Mechanisms for Model Behavior and Context

RhinoInsight: 通过模型行为和上下文的控制机制提升深度研究

Yu Lei, Shuzheng Si, Wei Wang, Yifei Wu, Gang Chen, Fanchao Qi, Maosong Sun

机构 * DeepLang AI Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Jiaotong University(北京交通大学)

AI总结 RhinoInsight通过引入可验证检查表和证据审计两种控制机制,提升深度研究任务的鲁棒性和可追溯性,同时保持在深度搜索任务中的竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18509 2025-11-25 cs.RO

SafeFall: Learning Protective Control for Humanoid Robots

SafeFall: 为双足机器人学习防护控制

Ziyu Meng, Tengyu Liu, Le Ma, Yingying Wu, Ran Song, Wei Zhang, Siyuan Huang

机构 * School of Control Science and Engineering, Shandong University(山东大学控制科学与工程学院) National Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室(BIGAI)) Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 SafeFall通过学习预测跌倒并执行防护动作,显著减少机器人跌倒时的损伤,提升人形机器人在复杂环境中的安全性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15065 2025-11-25 cs.CV cs.AI

Reasoning via Video: The First Evaluation of Video Models' Reasoning Abilities through Maze-Solving Tasks

通过视频推理:首次评估视频模型在迷宫解决任务中的推理能力

Cheng Yang, Haiyuan Wan, Yiran Peng, Xin Cheng, Zhaoyang Yu, Jiayi Zhang, Junchi Yu, Xinlei Yu, Xiawu Zheng, Dongzhan Zhou, Chenglin Wu

机构 * DeepWisdom Tsinghua University(清华大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Renmin University of China(中国人民大学) University of Oxford(牛津大学) National University of Singapore(新加坡国立大学) Xiamen University(厦门大学) Hong Kong University of Science and Technology (GuangZhou)(香港科技大学(广州))

AI总结 本文首次评估视频模型在迷宫解决任务中的推理能力,提出VR-Bench基准,展示视频生成在空间推理中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21354 2025-11-25 cs.CV cs.AI

KV-Efficient VLA: A Method to Speed up Vision Language Models with RNN-Gated Chunked KV Cache

KV-Efficient VLA: 一种加速视觉语言模型的方法通过RNN门控分块KV缓存

Wanshun Xu, Long Zhuang, Lianlei Shan

机构 * University of Toronto(多伦多大学) Tsinghua University(清华大学)

AI总结 KV-Efficient VLA通过RNN门控分块KV缓存机制,有效降低视觉语言模型的计算和内存开销,提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15480 2025-11-25 cs.LG

Learning Protein-Ligand Binding in Hyperbolic Space

在双曲空间中学习蛋白质-配体结合

Jianhui Wang, Wenyu Zhu, Bowen Gao, Xin Hong, Ya-Qin Zhang, Wei-Ying Ma, Yanyan Lan

机构 * Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国) University of Electronic Science and Technology of China, Chengdu, China(电子科技大学,成都,中国) Department of Computer Science and Technology, Tsinghua University, Beijing, China(计算机科学与技术系,清华大学,北京,中国) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院,北京,中国)

AI总结 HypSeek在双曲空间中学习蛋白质-配体结合,通过双曲几何提升虚拟筛选和亲和力排名性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18670 2025-11-25 cs.AI

MoveGPT: Scaling Mobility Foundation Models with Spatially-Aware Mixture of Experts

MoveGPT: 通过空间感知专家混合模型扩展移动基础模型

Chonghua Han, Yuan Yuan, Jingtao Ding, Jie Feng, Fanjin Meng, Yong Li

机构 * Department of Electronic Engineering, Tsinghua University(电子工程系,清华大学)

AI总结 MoveGPT通过空间感知专家混合模型实现大规模移动基础模型的扩展,提升多种下游任务性能,展现强泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13837 2025-11-25 cs.AI cs.CL cs.CV

Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?

强化学习真的能激励大语言模型在基础模型之外提升推理能力吗?

Yang Yue, Zhiqi Chen, Rui Lu, Andrew Zhao, Zhaokai Wang, Yang Yue, Shiji Song, Gao Huang

机构 * LeapLab, Tsinghua University(清华大学 LeapLab) Shanghai Jiao Tong University(上海交通大学)

AI总结 本研究发现RLVR方法未有效激发LLMs的新型推理能力,而蒸馏方法能更有效地扩展模型推理能力。

Comments 31 pages, 27 figures

Journal ref NeurIPS 2025 Oral; ICML 2025 AI4MATH workshop best paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05321 2025-11-25 cs.IR cs.AI cs.LG

VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search

VALUE: 用于通过加权前缀树进行查询重写的值感知大语言模型

Xiao Zhang, Guanyu Chen, Boyang Zuo, Feng Li, Pengjie Wang, Jian Xu, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 VALUE通过加权前缀树整合价值感知,提升搜索引擎广告中查询重写的语义相关性和商业价值

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17852 2025-11-25 cs.CV

Sketch-1-to-3: One Single Sketch to 3D Detailed Face Reconstruction

Sketch-1-to-3: 一个单轮廓到三维详细面部重建

Liting Wen, Zimo Yang, Xianlin Zhang, Chi Ding, Mingdao Wang, Xueming Li

机构 * Carnegie Mellon University(卡内基梅隆大学) Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

AI总结 Sketch-1-to-3通过引入GCTD模块和定制损失函数,实现从单个轮廓到高保真三维面部重建的突破性进展。

Comments Accepted by ACM MMAsia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15289 2025-11-25 cs.CR cs.AI cs.CL

SATA: A Paradigm for LLM Jailbreak via Simple Assistive Task Linkage

SATA: 一种通过简单辅助任务链接实现LLM劫持的范式

Xiaoning Dong, Wenbo Hu, Wei Xu, Tianxing He

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院) Hefei University of Technology(合肥工业大学)

AI总结 SATA通过简单辅助任务链接实现LLM劫持,有效绕过安全措施并提升攻击成功率

Comments ACL Findings 2025. Welcome to employ SATA as a baseline

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17265 2025-11-25 cs.CL cs.CV

Systematic Reward Gap Optimization for Mitigating VLM Hallucinations

系统性奖励缺口优化以缓解视觉语言模型的幻觉

Lehan He, Zeren Chen, Zhelun Shi, Tianyu Yu, Jing Shao, Lu Sheng

机构 * School of Software, Beihang University(北京航空航天大学软件学院) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学)

AI总结 TPR通过主题级偏好重写系统优化奖励缺口配置,显著减少VLM幻觉并提升对齐效果。

Comments 34 pages, 12 figures, Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18448 2025-11-25 cs.CV

EventBench: Towards Comprehensive Benchmarking of Event-based MLLMs

EventBench: 向事件驱动的大语言模型全面评估迈进

Shaoyu Liu, Jianing Li, Guanghui Zhao, Yunjian Zhang, Xiangyang Ji

机构 * Xidian University(西安电子科技大学) Tsinghua University(清华大学)

AI总结 EventBench通过八个任务指标和大规模数据集全面评估事件驱动MLLMs的能力,揭示其在细粒度识别和空间推理方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18367 2025-11-25 cs.CV

Alias-free 4D Gaussian Splatting

无别名的4D高斯散射

Zilong Chen, Huan-ang Gao, Delin Qu, Haohan Chi, Hao Tang, Kai Zhang, Hao Zhao

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Beijing Academy of Artificial Intelligence, BAAI(北京人工智能研究院,BAAI) Fudan University(复旦大学) Peking University(北京大学)

AI总结 本研究提出了一种无别名的4D高斯散射方法,通过引入最大采样频率公式和尺度自适应滤波器,有效减少渲染伪影并提升多视角视频重建效率。

Comments Project page: https://4d-alias-free.github.io/4D-Alias-free/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18293 2025-11-25 cs.RO

AIA-UltraNeRF:Acoustic-Impedance-Aware Neural Radiance Field with Hash Encodings for Robotic Ultrasound Reconstruction and Localization

AIA-UltraNeRF:具有哈希编码的声学阻抗感知神经辐射场用于机器人超声重建与定位

Shuai Zhang, Jingsong Mu, Cancan Zhao, Leiqi Tian, Zhijun Xing, Bo Ouyang, Xiang Li

机构 * School of Management, Hefei University of Technology(合肥工业大学管理学院) First Affiliated Hospital of University of Science and Technology of China(中国科学技术大学第一附属医院) Department of Ultrasound Diagnosis, the Second Xiangya Hospital of Central South University(中南大学湘雅医学院第二医院超声诊断科) Intelligent Ultrasound Division of VINNO Technology Co., Ltd.(VINNO技术有限公司智能超声事业部) Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 AIA-UltraNeRF通过引入声学阻抗感知和哈希编码技术,提升机器人超声重建与定位的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18287 2025-11-25 cs.LG cs.CV q-bio.QM

TRIDENT: A Trimodal Cascade Generative Framework for Drug and RNA-Conditioned Cellular Morphology Synthesis

TRIDENT: 一种用于药物和RNA条件细胞形态合成的三模态级联生成框架

Rui Peng, Ziru Liu, Lingyuan Ye, Yuxing Lu, Boxin Shi, Jinzhuo Wang

机构 * Department of Big Data and Biomedical AI, College of Future Technology, Peking University(大数据与生物医学人工智能系,未来技术学院,北京大学) Center for BioMed-X Research, Academy for Advanced Interdisciplinary Studies, Peking University(BioMed-X研究中心,先进跨学科研究学院,北京大学) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学) National Engineering Research Center of Visual Technology, School of Computer Science, Peking University(视觉技术国家工程研究中心,计算机科学学院,北京大学) Yuanpei College, Peking University(元培学院,北京大学) School of Life Sciences, Tsinghua University(生命科学学院,清华大学) Peking University-Tsinghua University-National Institute of Biological Sciences Joint Graduate Program (PTN), Tsinghua University(北京大学-清华大学-国家生物医学科学研究院联合研究生项目(PTN),清华大学)

AI总结 TRIDENT通过三模态级联生成框架,结合药物和RNA条件,实现了对细胞形态的高保真合成,显著提升了虚拟细胞的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17550 2025-11-25 cs.NE cs.AI cs.LG

Gate-level boolean evolutionary geometric attention neural networks

门级布尔进化几何注意力神经网络

Xianshuai Shi, Jianfeng Zhu, Leibo Liu

机构 * School of Integrated Circuits, Tsinghua University(集成电路学院,清华大学)

AI总结 本文提出一种基于布尔域的门级进化几何注意力神经网络,通过布尔反应-扩散机制实现图像处理,结合自注意力与RoPE技术,具备高效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04981 2025-11-25 cs.LG cs.AI q-bio.GN

Classification of autoimmune diseases from Peripheral blood TCR repertoires by multimodal multi-instance learning

通过多模态多实例学习对自身免疫性疾病进行外周血T细胞受体谱系的分类

Ruihao Zhang, Mao chen, Fei Ye, Dandan Meng, Yixuan Huang, Xiao Liu

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国)

AI总结 EAMil通过多模态多实例学习方法,利用TCR测序数据高精度诊断SLE和RA,并有效识别疾病相关基因。

Comments 4 figures, 3 tabels, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.04919 2025-11-25 cs.LG stat.ML

Learning with Shared Representations: Statistical Rates and Efficient Algorithms

通过共享表示进行学习:统计速率和高效算法

Xiaochun Niu, Lili Su, Jiaming Xu, Pengkun Yang

机构 * Fuqua School of Business, Duke University(达特茅斯大学福克商学院) Department of Electrical and Computer Engineering, Northeastern University(东北大学电气与计算机工程系) Department of Statistics and Data Science, Tsinghua University(清华大学统计与数据科学系)

AI总结 本文提出了一种通过共享表示进行学习的方法,建立了统计误差的新界限,并设计了高效的谱估计器,揭示了协作在迁移学习中的不同最优速率阶段。

详情

展开后加载摘要…

URL PDF HTML 收藏