arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2026-08-26 至 2026-08-26 共收录 22
2608.24724 2026-08-26 cs.RO 新提交

Fiber Bragg Grating Whiskers for Bioinspired Hydrodynamic Perception on Underwater Robots

用于水下机器人生物启发式流体动力感知的光纤布拉格光栅触须

Hao Li, Tianyu Tu, Siyue Yao, Ziyang Chang, Juhyun Jung, Xiaochi Xie, Long Yin Chung, Tian-Ao Ren, Genliang Chen, Mark Cutkosky

机构 * Stanford University(斯坦福大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 受港海豹触须流体感知能力启发,研发光纤布拉格光栅触须并验证其可辅助水下机器人仅通过触须信号区分直行与转弯,正确率达85%,为水下机器人流体感知提供新方案。

Comments 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24714 2026-08-26 cs.RO 新提交

GaussianWAM: Distilling Geometry and Semantics from 3D Gaussian Fields into World-Action Models

GaussianWAM:将三维高斯场的几何与语义知识蒸馏至世界-动作模型

Zijian Zhang, Yuqing Jiang, Weitao Zhou, Minglei Li, Jinhao Zhang, Yao Mu, Xiaofan Li, Hao Zhao, Haibao Yu

机构 * Tuojing Intelligence(拓境智能) University of Chinese Academy of Sciences(中国科学院大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Tsinghua University(清华大学) Simple AI(简智人工智能) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) The University of Hong Kong(香港大学)

AI总结 GaussianWAM是训练时的表征增强框架,通过三维高斯场蒸馏几何与语义监督,在LIBERO-Plus等任务上显著提升了WAM类模型的机器人操作性能,且不改变部署架构。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24696 2026-08-26 cs.LG cs.AI 新提交

On-policy Distillation with Verifiable Reward

结合可验证奖励的在线蒸馏

Wenze Lin, Jiale Zhao, Xitai Jiang, Songde Rao, Yining Li, Shenzhi Wang, Bingxiang He, Gao Huang

机构 * LeapLab, Tsinghua University(清华大学LeapLab) Beihang University(北京航空航天大学) SMS, Peking University(北京大学SMS) NLPLab, Tsinghua University(清华大学NLPLab)

AI总结 本研究提出OPDVR方法,无缝结合OPD与RLVR且不增加超参数,经六个推理基准实验验证其性能优于标准OPD。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24674 2026-08-26 cs.CV 新提交

TurboT2VA: Fast Large-Scale Text-to-Video-Audio Generation via Score-Regularized Consistency Distillation

TurboT2VA:基于分数正则化一致性蒸馏的快速大规模文本-视频-音频生成

Xiaoda Yang, Yuxiang Liu, Kaiwen Zheng, Yuan Liu, Yibo Lai, Shengpeng Ji, Kai Jiang, Jianfei Chen, Xiaobin Hu, Shuicheng Yan, Jintao Zhang, Jun Zhu, Zhou Zhao

机构 * Zhejiang University(浙江大学) Tianjin University(天津大学) Tsinghua University(清华大学) Qingdao University(青岛大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出TurboT2VA框架,通过多模态归一化与渐进式课程方案,在保持音视频生成质量的同时,大幅加速190亿参数联合T2VA模型的推理,在不同分辨率下实现最高54.67倍的生成器加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24658 2026-08-26 cs.AI 新提交

Parason: Revealing Subtask and Trial Parallelism in LLM Reasoning

Parason:揭示大语言模型推理中的子任务并行与试错并行

Zhengyang Zhang, Zijian Zhang, Jiaxuan Gao, Shusheng Xu, Yi Wu, Song Han, Ligeng Zhu

机构 * Tsinghua University(清华大学) NVIDIA(英伟达) Massachusetts Institute of Technology(麻省理工学院)

AI总结 Parason揭示LLM推理的子任务与试错并行,用上下文无关文法转换轨迹,经PA-GRPO训练,在数学基准上实现约1.7倍加速且保持竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24488 2026-08-26 cs.LG 新提交

Where Entropy Is Measured Matters: Policy Geometry in Bounded Continuous-Control PPO

熵的测量位置很重要:有界连续控制PPO中的策略几何

Yiyang He, Zhichun Zhou, Ziwei Wang, Tao Xue, Haolin Fei

机构 * Lancaster University(兰卡斯特大学) Beihang University(北京航空航天大学) Tsinghua University(清华大学)

AI总结 该研究发现熵的测量位置会影响PPO学习的有界连续控制策略几何,通过MyoLeg、Dog-Stand任务实验,表明熵测量空间是均值-方差耦合的设计选择,仅任务回报无法表征有界策略几何。

Comments 24 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24485 2026-08-26 cs.RO cs.LG 新提交

NeuralParker: A Reinforcement Learning Planner for Irregular Parking Environments

NeuralParker:面向不规则停车环境的强化学习规划器

Zihan Wang, Bai Huang, Yang Guan, Xiao Li, Haoyu Xu, Naizheng Wang, Shengbo Eben Li

机构 * Tsinghua University(清华大学) Central University of Finance and Economics(中央财经大学) Meituan(美团)

AI总结 NeuralParker是面向不规则泊车环境的强化学习混合规划器,采用目标相对全局表示与终端集成器,在基准测试及实车验证中均优于基线,规划成功率与轨迹质量更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24441 2026-08-26 cs.AI 新提交

A Behavior-Guided Online Probabilistic Forecasting Method for Electric vehicle Charging Loads

面向电动汽车充电负荷的行为引导型在线概率预测方法

Chenghan Li, Qingxiang Liu, Yinliang Xu, Yuxuan Liang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Intelligent Transportation Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)智能交通学域)

AI总结 针对电动汽车充电负荷的行为异质性与时间变异性挑战,提出行为引导型在线概率预测框架,经10个真实充电站实验,其在1小时、4小时预测中均显著优于基线方法,实现稳定性能提升。

Comments Submitted to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24155 2026-08-26 cs.RO 新提交

Coverage Planning for Robotic Tooth Preparation in Densely Constrained Environments

密集受限环境下机器人牙齿预备的覆盖规划

Yunwen Li, Chen Chen, Xiangjie Yan, Chang Shu, Jianxia Hou, Shiji Song, Xiang Li

机构 * Tsinghua University(清华大学) ETH Zürich(苏黎世联邦理工学院) Tsingscribe Medical Ltd.(清scribe医疗有限公司) Peking University School and Hospital of Stomatology(北京大学口腔医学院) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

AI总结 本文提出一种用于自主全冠牙齿预备的机器人系统,通过感知解剖结构的刀具路径规划算法和面向间隙的末端执行器偏航角分配策略,实现精准牙面铣削,平均几何偏差0.117mm,经仿真和头模实验验证其可行性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24024 2026-08-26 cs.AI 新提交

Beyond Confidence: Test-Time Scaling for Multi-Turn Search Agents via Retrieval Grounding

超越置信度:基于检索 grounding 的多轮搜索智能体测试时缩放

Hyunho Kook, Junhyuk So, Tianyu Fu, Haizhong Zheng, Beidi Chen

机构 * University of Southern California(南加州大学) Pohang University of Science and Technology (POSTECH)(浦项科技大学) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 针对多轮搜索智能体中基于置信度投票因复制膨胀失效的问题,提出检索接地投票(RGV)方法,在四个基准和五个 LLM 上性能优于基线,准确率最高提升 5.4%

Comments Accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23200 2026-08-26 cs.CL 版本更新

LongWoF-Bench: Evaluating EvoMap Genes for Verifiable Long-Workflow Tasks

LongWoF-Bench:评估用于可验证长工作流任务的EvoMap基因

Xiao Zhang, Qumeng Sun, Jiahao Li, Yiming Ren, Xiang Liu, Haoyang Zhang, Junjie Wang

机构 * EvoMap Tsinghua University(清华大学)

AI总结 该研究提出LongWoF-Bench基准,发现通过EvoMap将验证的执行轨迹转化为可复用的Gene,能显著提升多模型在长工作流任务上的表现,且优于Skill和参考蒸馏的Gene。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22174 2026-08-26 cs.CV 版本更新

When Does Visual Generation Help Visual Understanding in Unified Multimodal Models?

统一多模态模型中视觉生成何时能助力视觉理解?

Yubo Zhu, Zhehan Kan, Jingyi Yang, Miaolin Chen, Jinbo Xing, Kai Zhu, Zijian Wang, Sheng Zhong, Wei Tong

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Fudan University(复旦大学)

AI总结 本研究提出VGAU-Diag评估框架,发现统一多模态模型的视觉生成仅在简单任务上助益理解,瓶颈多在理解侧,有效生成需瞄准理解瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22055 2026-08-26 cs.AI 版本更新

GenCoord: Skill-Path Commitments under Private Information

Peng He, Junning Zhu, Haohan Yuan, Jianpeng Liang

机构 * Tsinghua University(清华大学) Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校) University of California San Diego(加利福尼亚大学圣迭戈分校)

Comments Paper source and compact evidence: this https URL (https://github.com/JulianZJN/GenCoord)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13431 2026-08-26 cs.LG cs.AI cs.CL 版本更新

Discrete Diffusion Models: A Unified Framework from Tokenization to Generation

离散扩散模型:从词元化到生成的统一框架

Ye Yuan, Weien Li, Rui Song, Zeyu Li, Haochen Liu, Xiangyu Kong, Zixuan Dong, Linfeng Du, Zipeng Sun, Weixu Zhang, Jiaxin Huang, Changjiang Han, Yonghan Yang, Zichen Zhao, Xiuyuan Hu, Haolun Wu, Yankai Chen, Fengran Mo, Jikun Kang, Bowei He, Dawn Song, Philip S. Yu, Xue Liu

机构 * McGill University(麦吉尔大学) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) University of Cambridge(剑桥大学) University of Toronto(多伦多大学) MBZUAI - Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Tsinghua University(清华大学) Rochester Institute of Technology(罗彻斯特理工学院) Salesforce(Salesforce公司) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

AI总结 研究离散扩散模型,引入统一框架从离散状态空间构建审视该模型,让现有公式成为共同设计空间实例,揭示训练、推理等方面权衡,为未来研究提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28791 2026-08-26 cs.CL cs.AI 版本更新

Skill-Conditioned Gated Self-Distillation for LLM Reasoning

技能条件门控自蒸馏用于大语言模型推理

Jiazhen Huang, Xiao Chen, Xiao Luo, Yong Dai, Senkang Hu, Yuzhi Zhao

机构 * Tsinghua University(清华大学) Fudan University(复旦大学) City University of Hong Kong(香港城市大学) Huazhong University of Science and Technology(华中科技大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 提出技能条件门控自蒸馏(SGSD),通过从经验技能库中检索技能-错误对构建多教师池,并利用验证器验证教师极性,以鲁棒门控目标蒸馏信息性师生差异,在弱先验信息假设下提升数学推理性能。

Comments Accepted by EMNLP 2026 Findings. Code is available at this https URL (https://github.com/walawalagoose/SGSD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09477 2026-08-26 cs.CV cs.AI 版本更新

Outlier-Robust Diffusion Solvers for Inverse Problems

具有鲁棒性的扩散求解器用于逆问题

Yang Zheng, Jiahua Liu, Tongyao Pang, Wen Li, Zhaoqiang Liu

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Yau Mathematical Sciences Center, Tsinghua University(清华大学尤太数学科学中心)

AI总结 本文提出一种鲁棒扩散求解器,通过噪声估计和Huber损失构建迭代加权最小二乘目标,以解决逆问题中的异常值问题,并在多个图像数据集上验证了其有效性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00188 2026-08-26 cs.CV cs.AI cs.LG 版本更新

ST-Lite: Training-Free KV Cache Compression with Spatio-Trajectory Guidance for Long-Horizon GUI Agents

通过无训练KV缓存压缩实现高效的长周期GUI代理

Bowen Zhou, Zhou Xu, Wanli Li, Jingyu Xiao, Pingan Gan, Haoqian Wang

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 ST-Lite通过无训练的KV缓存压缩方法,提升GUI代理的解码效率,实现2.45倍加速并保持性能优势。

Comments Accepted to Findings of EMNLP 2026. Camera-ready version. 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22293 2026-08-26 cs.LG physics.geo-ph 版本更新

Topology enables learning-based hydrodynamic prediction of the global river system

基于拓扑信息的AI基础模型实现全球河流预报

Hancheng Ren, Gang Zhao, Shuo Wang, Louise Slater, Dai Yamazaki, Shu Liu, Jingfang Fan, Xueying Li, Shibo Cui, Ziming Yu, Shengyu Kang, Depeng Zuo, Dingzhi Peng, Zongxue Xu, Bo Pang

机构 * College of Water Sciences, Beijing Normal University, Beijing, China(北京师范大学水科学学院) School of Geography and the Environment, University of Oxford, Oxford, UK(牛津大学地理与环境学院) Department of Transdisciplinary Science and Engineering, Institute of Science Tokyo, Tokyo, Japan(东京科学研究所跨学科科学与工程系) School of Systems Science, Beijing Normal University, Beijing, China(北京师范大学系统科学学院) Institute of Industrial Science, University of Tokyo, Tokyo, Japan(东京大学工业科学研究所) China Institute of Water Resources and Hydropower Research, Beijing, China(中国水利水电科学研究院) State Key Laboratory of Hydro-Science and Engineering, Department of Hydraulic Engineering, Tsinghua University, Beijing, China(清华大学水利科学与工程国家重点实验室) School of Artificial Intelligence, Beijing Normal University, Beijing, China(北京师范大学人工智能学院) School of Water Resources and Hydropower Engineering, Wuhan University, Wuhan, China(武汉大学水利水电学院)

AI总结 GraphRiverCast通过拓扑信息和物理对齐的神经操作符架构,实现了全球河流系统的系统性水动力模拟,无需历史数据即可进行稳健预测。

Comments 21 pages, 4 figures. Main text only; the supplementary materials accompany the journal version

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10485 2026-08-26 cs.AI 版本更新

Panning for Gold: Expanding Domain-Specific Knowledge Graphs with General Knowledge

寻找黄金:利用通用知识图谱扩展领域特定知识图谱

Runhao Zhao, Weixin Zeng, Wentao Zhang, Chong Chen, Zhengpin Li, Xiang Zhao, Lei Chen

机构 * National Key Laboratory of Big Data and Decision(大数据与决策国家重点实验室) National University of Defense Technology(国防科技大学) The Center for machine learning research(机器学习研究中心) Peking University(北京大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出领域特定知识图谱融合任务,通过神经符号框架ExeFuse,利用通用知识图谱提升领域知识图谱的完整性和实用性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11684 2026-08-26 cs.CL cs.AI cs.HC 版本更新

PatientHub: A Unified Framework for Patient Simulation

PatientHub: 一个统一的患者模拟框架

Sahand Sabour, TszYam NG, Minlie Huang

机构 * The CoAI Group, DCST Institute for Artificial Intelligence Tsinghua University(CoAI集团、DCST人工智能研究所清华大学)

AI总结 PatientHub提供了一个统一的患者模拟框架,通过标准化定义、组成和部署,促进跨方法和跨模型的基准测试,并降低新方法开发的门槛。

Comments EMNLP 2026 Demo Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16520 2026-08-26 cs.CV cs.AI cs.CL 版本更新

TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning

TangramPuzzle: 通过组合空间推理评估多模态大语言模型

Daixian Liu, Jiayi Kuang, Yinghui Li, Yangning Li, Di Yin, Haoyu Cao, Xing Sun, Ying Shen, Hai-Tao Zheng, Liang Lin, Philip S. Yu

机构 * Tsinghua University(清华大学) Sun-Yat Sen University(孙逸人大学) Tencent Youtu Lab(腾讯优图实验室) University of Illinois Chicago(伊利诺伊大学香槟分校)

AI总结 TangramPuzzle通过几何基准测试评估多模态大语言模型的组合空间推理能力,发现模型在匹配轮廓时忽视几何约束,导致碎片变形。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08626 2026-08-26 cs.CL 版本更新

How Order-Sensitive Are LLMs? OrderProbe for Deterministic Structural Reconstruction

大语言模型对顺序敏感性如何?OrderProbe用于确定性结构重建

Zhaolu Kang, Yingjie He, Kehan Jiang, Leqi Zheng, Jiachen Qian, Qianyuan Zhang, Chunlei Meng, Yujie Feng, Yuan Wang, Stephen Dou, Aming Wu, Pengxiang Zhao, Jiaxin Liu, Guansu Wang, Zeyu Zhang, Lei Wang, Qishi Zhan, Xiaomin He, Meisheng Zhang, Jianyuan Ni, Richeng Xuan

机构 * Peking University(北京大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) City University of Hong Kong(香港城市大学) Fudan University(复旦大学) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校) Marquette University(马凯特大学) Juniata College(朱尼阿特学院)

AI总结 研究通过OrderProbe基准评估大语言模型对输入顺序的敏感性,发现即使在前沿模型上,结构重建仍面临挑战,且语义能力与结构鲁棒性存在脱节。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏