arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2026-01-28 至 2026-01-28 共收录 15
2601.19834 2026-01-28 cs.AI

Visual Generation Unlocks Human-Like Reasoning through Multimodal World Models

视觉生成通过多模态世界模型解锁类人推理

Jialong Wu, Xiaoying Zhang, Hongyi Yuan, Xiangcheng Zhang, Tianhao Huang, Changjing He, Chaoyi Deng, Renrui Zhang, Youbin Wu, Mingsheng Long

机构 * Tsinghua University(清华大学)

AI总结 本文提出视觉生成在特定任务中优于纯语言推理,通过构建VisWorld-Eval评估套件验证了多模态世界模型提升类人推理的能力。

Comments Project page: https://thuml.github.io/Reasoning-Visual-World

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19707 2026-01-28 cs.LG cs.RO

Scalable Exploration for High-Dimensional Continuous Control via Value-Guided Flow

通过价值引导流实现高维连续控制的可扩展探索

Yunyue Wei, Chenhui Zuo, Yanan Sui

机构 * Tsinghua University(清华大学)

AI总结 Qflex通过价值引导流在高维动作空间中实现高效探索,优于现有方法并在复杂控制任务中表现出色。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19606 2026-01-28 cs.CV cs.AI cs.LG cs.SD eess.AS

GMS-CAVP: Improving Audio-Video Correspondence with Multi-Scale Contrastive and Generative Pretraining

GMS-CAVP:通过多尺度对比和生成预训练提升音频视频对应关系

Shentong Mo, Zehua Chen, Jun Zhu

机构 * Carnegie Mellon University(卡内基梅隆大学) MBZUAI Tsinghua University(清华大学)

AI总结 GMS-CAVP通过多尺度对比和生成预训练方法提升音频视频对应关系建模,实现更深入的跨模态理解和高保真生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19578 2026-01-28 cs.CL

Yunque DeepResearch Technical Report

Yunque DeepResearch 技术报告

Yuxuan Cai, Xinyi Lai, Peng Yuan, Weiting Liu, Huajian Li, Mingda Li, Xinghua Wang, Shengxie Zheng, Yanchao Hao, Yuyang Yin, Zheng Wei

机构 * Tencent BAC(腾讯BAC) Tsinghua University(清华大学) Fudan University(复旦大学)

AI总结 Yunque DeepResearch提出了一种分层、模块化且稳健的框架,通过多代理协调、动态上下文管理和主动监督模块解决深度研究中的关键挑战,实现先进性能并开源支持社区发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19430 2026-01-28 cs.CV

Unveiling Perceptual Artifacts: A Fine-Grained Benchmark for Interpretable AI-Generated Image Detection

揭示感知伪影:一个可解释AI生成图像检测的细粒度基准

Yao Xiao, Weiyan Chen, Jiahao Chen, Zijie Cao, Weijian Deng, Binbin Yang, Ziyi Dong, Xiangyang Ji, Wei Ke, Pengxu Wei, Liang Lin

机构 * Sun Yat-sen University(中山大学) Peng Cheng Laboratory(鹏城实验室) Xi’an Jiaotong University(西安交通大学) Australian National University(澳大利亚国立大学) Tsinghua University(清华大学)

AI总结 本文提出X-AIGD基准,通过细粒度注释感知伪影,揭示现有AIGI检测器对伪影的依赖低,且需提升可解释性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19354 2026-01-28 cs.RO cs.SY eess.SY

Self-Supervised Path Planning in Unstructured Environments via Global-Guided Differentiable Hard Constraint Projection

通过全局引导可微硬约束投影实现无结构环境中的自监督路径规划

Ziqian Wang, Chenxi Fang, Zhen Zhang

机构 * State Key Laboratory of Tribology in Advanced Equipment, Tsinghua University(摩擦学国家重点实验室(先进装备)) Beijing Key Laboratory of Transformative High-end Manufacturing Equipment and Technology, Department of Mechanical Engineering, Tsinghua University(北京高端制造装备与技术关键实验室(机械工程系)) Automotive Electronics Business Unit at Hirain Inc.(惠而得(中国)汽车电子业务部)

AI总结 本文提出一种自监督路径规划框架,通过全局引导人工势场和可微硬约束投影层,提升无结构环境中自主导航的安全性和实时性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08931 2026-01-28 cs.CV cs.AI cs.LG

Astra: General Interactive World Model with Autoregressive Denoising

Astra:通用交互世界模型与自回归去噪

Yixuan Zhu, Jiaqi Feng, Wenzhao Zheng, Yuan Gao, Xin Tao, Pengfei Wan, Jie Zhou, Jiwen Lu

机构 * Tsinghua University(清华大学) Kuaishou Technology(快手科技)

AI总结 Astra提出了一种通用交互世界模型,通过自回归去噪和动作感知适配器实现长周期视频预测与多样化交互。

Comments Accepted in ICLR 2026. Code is available at: https://github.com/EternalEvan/Astra

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17171 2026-01-28 cs.CV

Generation then Reconstruction: Accelerating Masked Autoregressive Models via Two-Stage Sampling

生成然后重建:通过两阶段采样加速遮蔽自回归模型

Feihong Yan, Peiru Wang, Yao Zhu, Kaiyu Pang, Qingyan Wei, Huiqi Li, Linfeng Zhang

机构 * Beijing Institute of Technology(北京理工大学) EPIC Lab, SJTU(上海交通大学EPIC实验室) Tsinghua University(清华大学)

AI总结 GtR通过两阶段采样加速遮蔽自回归模型,实现3.72倍速度提升并保持高质量生成。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11027 2026-01-28 cs.CV

Vlaser: Vision-Language-Action Model with Synergistic Embodied Reasoning

Vlaser:具有协同具身推理能力的视觉-语言-动作模型

Ganlin Yang, Tianyi Zhang, Haoran Hao, Weiyun Wang, Yibin Liu, Dehui Wang, Guanzhou Chen, Zijian Cai, Junting Chen, Weijie Su, Wengang Zhou, Yu Qiao, Jifeng Dai, Jiangmiao Pang, Gen Luo, Wenhai Wang, Yao Mu, Zhi Hou

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) Nanjing University(南京大学) Fudan University(复旦大学) Tsinghua University(清华大学) NUS(新加坡国立大学) Northeastern University(东北大学) Shenzhen University(深圳大学)

AI总结 Vlaser通过整合高级推理与低级控制,解决了具身推理与VLA策略学习之间的关键差距,在多个基准测试中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21044 2026-01-28 cs.LG cs.AI

Reinforcement Learning Fine-Tuning Enhances Activation Intensity and Diversity in the Internal Circuitry of LLMs

强化学习微调增强大语言模型内部电路的激活强度和多样性

Honglin Zhang, Qianyue Hao, Fengli Xu, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系,BNRist,清华大学)

AI总结 强化学习微调增强了LLMs内部电路的激活强度和多样性,相较于偏好优化方法,其在数学泛化上的优势源于信息流的冗余与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20674 2026-01-28 cs.RO cs.CV

Equi-RO: A 4D mmWave Radar Odometry via Equivariant Networks

等变RO:一种基于等变网络的4D毫米波雷达里程计

Zeyu Han, Shuocheng Yang, Minghan Zhu, Fang Zhang, Shaobing Xu, Maani Ghaffari, Jianqiang Wang

机构 * School of Vehicle and Mobility, Tsinghua University(车辆与移动系统学院,清华大学) Computational Autonomy and Robotic Laboratory, University of Michigan(计算自主与机器人实验室,密歇根大学) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(智能绿色车辆与移动系统国家重点实验室,清华大学)

AI总结 本文提出Equi-RO,一种基于等变网络的4D毫米波雷达里程计方法,通过图结构增强稀疏雷达数据特征聚合,实现更准确的平移和旋转估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14140 2026-01-28 cs.AI

RL of Thoughts: Navigating LLM Reasoning with Inference-time Reinforcement Learning

思维强化学习:通过推理时间强化学习导航大语言模型推理

Qianyue Hao, Sibo Li, Jian Yuan, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系、BNRist、清华大学)

AI总结 RL-of-Thoughts通过强化学习训练轻量级导航模型,提升大语言模型推理能力,实现多任务适应性和参数高效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11234 2026-01-28 cs.LG cs.AI

Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning

贝叶斯自适应蒙特卡洛树搜索用于离线模型驱动强化学习

Jiayu Chen, Le Xu, Wentse Chen, Jeff Schneider

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出贝叶斯自适应蒙特卡洛树搜索算法,用于提升离线模型驱动强化学习的性能,显著优于现有方法。

Comments This paper is accepted in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13547 2026-01-28 cs.CL

ThinkNote: Enhancing Knowledge Integration and Utilization of Large Language Models via Constructivist Cognition Modeling

ThinkNote: 通过建构主义认知建模增强大型语言模型的知识整合与利用

Zhipeng Xu, Zhenghao Liu, Yukun Yan, Shuo Wang, Shi Yu, Zheni Zeng, Chaojun Xiao, Zhiyuan Liu, Ge Yu, Chenyan Xiong

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)

AI总结 ThinkNote通过建构主义认知建模提升大型语言模型的知识整合与利用能力,实验表明其在问答任务中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18829 2026-01-28 cs.LG cs.AI

CP Loss: Channel-wise Perceptual Loss for Time Series Forecasting

CP Loss:时间序列预测中的通道感知损失

Yaohua Zha, Chunlin Fan, Peiyuan Liu, Yong Jiang, Tao Dai, Hai Wu, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Institute of Perceptual Intelligence, Pengcheng Laboratory(感知智能研究院) College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)

AI总结 本文提出CP Loss,通过为每个通道学习独特的感知空间,提升时间序列预测中对通道特定动态的捕捉能力。

Comments Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏