arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2025-12-02 至 2025-12-02 共收录 19
2502.07663 2025-12-02 cs.AI cs.CL cs.CY cs.HC

Human Decision-making is Susceptible to AI-driven Manipulation

人类决策易受AI驱动的操控

Sahand Sabour, June M. Liu, Siyang Liu, Chris Z. Yao, Shiyao Cui, Xuanming Zhang, Wen Zhang, Yaru Cao, Advait Bhat, Jian Guan, Wei Wu, Rada Mihalcea, Hongning Wang, Tim Althoff, Tatia M. C. Lee, Minlie Huang

机构 * The CoAI Group, DCST, Institute for Artificial Intelligence, Tsinghua University, Beijing, China(CoAI小组、DCST、人工智能研究所、清华大学、北京中国) State Key Laboratory of Brain and Cognitive Sciences, The University of Hong Kong, Hong Kong SAR, China(脑与认知科学国家重点实验室、香港大学、香港特别行政区中国) The LIT Group, Department of Computer Science and Engineering, University of Michigan, Ann Arbor(LIT小组、计算机科学与工程系、密歇根大学、安阿伯) Paul G. Allen School of Computer Science and Engineering, University of Washington, Seattle, WA, USA(保罗·G·阿伦计算机科学与工程学院、华盛顿大学、西雅图华盛顿州美国) ANT Group(ANT集团)

AI总结 研究发现人类在金融和情感决策中易受AI操控,操控代理显著提高了用户对隐藏激励的评分,表明需加强伦理监管以保护自主权。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01446 2025-12-02 cs.RO

$\mathbf{M^3A}$ Policy: Mutable Material Manipulation Augmentation Policy through Photometric Re-rendering

M³A策略:通过光度重渲染的可变材料操控增强策略

Jiayi Li, Yuxuan Hu, Haoran Geng, Xiangyu Chen, Chuhao Zhou, Ziteng Cui, Jianfei Yang

机构 * Tsinghua University(清华大学) MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室) University of California, Berkeley(加州大学伯克利分校) The University of Tokyo(东京大学)

AI总结 M³A策略通过光度重渲染生成多样化演示,提升机器人跨材料操控的泛化能力。

Comments under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01426 2025-12-02 cs.CV

ResDiT: Evoking the Intrinsic Resolution Scalability in Diffusion Transformers

ResDiT: 在扩散变换器中激发内在分辨率可扩展性

Yiyang Ma, Feng Zhou, Xuedan Yin, Pu Cao, Yonghao Dang, Jianqin Yin

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学)

AI总结 ResDiT通过改进位置嵌入和局部增强机制,实现了无需训练的高分辨率图像生成,有效解决空间布局崩溃和纹理保真度下降问题。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01383 2025-12-02 cs.CV

PointNet4D: A Lightweight 4D Point Cloud Video Backbone for Online and Offline Perception in Robotic Applications

PointNet4D: 一种轻量级的4D点云视频主干网络,用于机器人应用中的在线和离线感知

Yunze Liu, Zifan Wang, Peiran Wu, Jiayang Ao

机构 * Tsinghua University(清华大学) University of Bristol(布里斯托大学) The University of Melbourne(墨尔本大学)

AI总结 PointNet4D是一种轻量级4D点云视频主干网络,通过混合Mamba-Transformer时间融合模块和4DMAP预训练策略,提升机器人应用中的在线和离线感知性能。

Comments Accepted by WACV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01189 2025-12-02 cs.AI cs.LG

fMRI2GES: Co-speech Gesture Reconstruction from fMRI Signal with Dual Brain Decoding Alignment

fMRI2GES: 从fMRI信号中利用双脑解码对齐进行同步语音手势重建

Chunzheng Zhu, Jialin Shao, Jianxin Lin, Yijun Wang, Jing Wang, Jinhui Tang, Kenli Li

机构 * College of Information Science and Engineering, Hunan University(湖南大学信息科学与工程学院) School of Computer Science and Technology, Nanjing University of Science and Technology(南京理工大学计算机科学与技术学院) Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 fMRI2GES通过双脑解码对齐方法,利用无配对数据实现从fMRI信号到同步语音手势的重建,提升神经科学认知。

Comments IEEE Transactions on Circuits and Systems for Video Technology (TCSVT) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00903 2025-12-02 cs.CV cs.RO

SwiftVLA: Unlocking Spatiotemporal Dynamics for Lightweight VLA Models at Minimal Overhead

SwiftVLA: 解锁轻量VLA模型的时空动态以最小的开销

Chaojun Ni, Cheng Chen, Xiaofeng Wang, Zheng Zhu, Wenzhao Zheng, Boyuan Wang, Tianrun Chen, Guosheng Zhao, Haoyun Li, Zhehao Dong, Qiang Zhang, Yun Ye, Yang Wang, Guan Huang, Wenjun Mei

机构 * GigaAI Peking University(北京大学) Moxin (Huzhou) Technology Co., Ltd.(摩西(湖州)科技有限公司) Tsinghua University(清华大学) X-Humanoid Project(X-人形项目)

AI总结 SwiftVLA通过4D视觉几何Transformer和Fusion Tokens提升轻量VLA模型的时空推理能力,实现高效且性能优异的视觉-语言-动作处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00797 2025-12-02 cs.RO

Transforming Monolithic Foundation Models into Embodied Multi-Agent Architectures for Human-Robot Collaboration

将单体基础模型转化为具身体验的多智能体架构以实现人机协作

Nan Sun, Bo Mao, Yongchang Li, Chenxu Wang, Di Guo, Huaping Liu

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(人工智能学院,北京邮电大学)

AI总结 InteractGen通过分解机器人智能为多个智能体,提升服务机器人在人类环境中的自主性和协作能力。

Comments 21 pages, 16 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00722 2025-12-02 cs.AI

SpeContext: Enabling Efficient Long-context Reasoning with Speculative Context Sparsity in LLMs

SpeContext: 通过推测上下文稀疏性在LLMs中实现高效的长上下文推理

Jiaming Xu, Jiayi Pan, Hanzhen Wang, Yongkang Zhou, Jiancai Ye, Yu Wang, Guohao Dai

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 SpeContext通过推测上下文稀疏性,在LLMs中实现高效的长上下文推理,显著提升云和边缘环境的吞吐量和速度,同时保持精度。

Comments Accepted by ASPLOS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00493 2025-12-02 cs.CV

CC-FMO: Camera-Conditioned Zero-Shot Single Image to 3D Scene Generation with Foundation Model Orchestration

CC-FMO:基于相机的零样本单图像到3D场景生成与基础模型协调

Boshi Tang, Henry Zheng, Rui Huang, Gao Huang

机构 * Tsinghua University(清华大学)

AI总结 CC-FMO通过结合语义感知和结构化潜在表示,实现基于相机的零样本单图像到3D场景生成,提升场景连贯性和实例保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00473 2025-12-02 cs.CV cs.AI

RealGen: Photorealistic Text-to-Image Generation via Detector-Guided Rewards

RealGen:通过检测器引导的奖励实现逼真文本到图像生成

Junyan Ye, Leiqi Zhu, Yuncheng Guo, Dongzhi Jiang, Zilong Huang, Yifan Zhang, Zhiyuan Yan, Haohuan Fu, Conghui He, Weijia Li

机构 * Shanghai AI Lab(上海人工智能实验室) Sun Yat-Sen University(中山大学) Nanjing University(南京大学) CUHK MMLab(香港中文大学多模态实验室) Tsinghua University(清华大学) Peking University(北京大学)

AI总结 RealGen通过检测器引导的奖励机制提升文本到图像生成的真实感和细节,优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00406 2025-12-02 cs.AI cs.LG

GreenPlanner: Practical Floorplan Layout Generation via an Energy-Aware and Function-Feasible Generative Framework

GreenPlanner: 通过一种能耗感知且功能可行的生成框架实现实用的楼地板布局生成

Pengyu Zeng, Yuqin Dai, Jun Yin, Jing Zhong, Ziyang Han, Chaoyang Shi, ZhanXiang Jin, Maowei Jiang, Yuxing Han, Shuai Lu

机构 * Tsinghua University(清华大学)

AI总结 GreenPlanner通过能耗感知和功能可行的生成框架,实现高效、合规的楼地板布局生成,提升设计效率和准确性。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00391 2025-12-02 cs.LG cs.AI

From Coefficients to Directions: Rethinking Model Merging with Directional Alignment

从系数到方向:重新思考模型融合与方向对齐

Zhikang Chen, Sen Cui, Deheng Ye, Min Zhang, Gang Niu, Yu Zhang, Masashi Sugiyama, Tingting Zhu

机构 * University of Oxford(牛津大学) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) East China Normal University(华东师范大学) RIKEN(日本研究机构) The University of Tokyo(东京大学) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出方向对齐融合方法,通过统一几何框架对齐参数和特征空间的方向结构,提升模型融合的结构一致性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05068 2025-12-02 cs.CV cs.AI cs.CR

ICAS: Detecting Training Data from Autoregressive Image Generative Models

ICAS: 从自回归图像生成模型中检测训练数据

Hongyao Yu, Yixiang Qiu, Yiheng Yang, Hao Fang, Tianqu Zhuang, Jiaxin Hong, Bin Chen, Hao Wu, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳学院) Shenzhen ShenNong Information Technology Co., Ltd.(深圳深农信息技术有限公司)

AI总结 ICAS通过隐含分类和自适应得分聚合策略,从自回归图像生成模型中检测训练数据,揭示了大型模型的脆弱性,并展示了在不同场景下的有效性。

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18583 2025-12-02 cs.LG cs.PF

PARD: Accelerating LLM Inference with Low-Cost PARallel Draft Model Adaptation

PARD:通过低成本并行草稿模型适应加速大语言模型推理

Zihao An, Huajun Bai, Ziqiong Liu, Dong Li, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司) Tsinghua University(清华大学)

AI总结 PARD通过低成本并行草稿模型适应技术,显著提升大语言模型推理速度,实现3.67倍加速。

Comments Submitted for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05808 2025-12-02 cs.CV cs.MM

SizeGS: Size-aware Compression of 3D Gaussian Splatting via Mixed Integer Programming

SizeGS: 通过混合整数规划实现3D高斯点云的尺寸感知压缩

Shuzhao Xie, Jiahang Liu, Weixiang Zhang, Shijia Ge, Sicheng Pan, Chen Tang, Yunpeng Bai, Cong Zhang, Xiaoyi Fan, Zhi Wang

机构 * SIGS, Tsinghua University(清华大学SIGS实验室) Harbin Institute of Technology(哈尔滨工业大学) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab) The University of Texas at Austin(德克萨斯大学奥斯汀分校) Jiangxing Intelligence Inc.(江行智能有限公司)

AI总结 SizeGS通过混合整数规划优化3DGS的超参数,实现高效尺寸感知压缩,提升压缩效率和视觉质量。

Comments Automatically compressing 3DGS into the desired file size while maximizing the visual quality

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04741 2025-12-02 cs.AI cs.CL cs.HC

Question Answering for Decisionmaking in Green Building Design: A Multimodal Data Reasoning Method Driven by Large Language Models

绿色建筑设计中的决策制定问答:一种由大语言模型驱动的多模态数据推理方法

Yihui Li, Xiaoyue Yan, Hao Zhou, Borong Lin

机构 * School of Architecture(建筑学院) Tsinghua University(清华大学)

AI总结 本研究提出GreenQA,一种由大语言模型驱动的多模态数据推理方法,用于提升绿色建筑设计决策效率。

Comments Published at Association for Computer Aided Design in Architecture (ACADIA) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17655 2025-12-02 cs.RO cs.AI cs.MA

AssistantX: An LLM-Powered Proactive Assistant in Collaborative Human-Populated Environment

AssistantX: 一种基于大语言模型的协作人类 populated 环境中的主动助手

Nan Sun, Bo Mao, Yongchang Li, Di Guo, Huaping Liu

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) School of Artificial Intelligence, Beijing University of Posts and Telecommunications(人工智能学院,北京邮电大学)

AI总结 AssistantX 是一种基于大语言模型的主动助手,通过多代理框架实现自主操作,具备高级推理能力和协作意识,能有效响应用户指令并主动寻求帮助以完成任务。

Comments 8 pages, 10 figures, 6 tables

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Hangzhou, China, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01294 2025-12-02 cs.LG stat.ML

Deep sub-ensembles meets quantile regression: uncertainty-aware imputation for time series

深度子集成方法结合分位数回归:面向时间序列的不确定性感知填补

Ying Liu, Peng Cui, Wenbo Hu, Richang Hong

机构 * Department of Computer and Information(计算机与信息系) Hefei University of Technology(合肥工业大学) Dept. of Comp. Sci. & Tech.(计算机科学与技术系) Tsinghua University(清华大学)

AI总结 本文提出Quantile Sub-Ensembles方法,结合分位数回归和非生成框架,实现时间序列缺失值填补的高可靠性与高效性。

Comments Published in Machine Learning, 114, 268 (2025). DOI: 10.1007/s10994-025-06922-x

Journal ref Machine Learning, 114, 268 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00305 2025-12-02 cs.AI

ChartPoint: Guiding MLLMs with Grounding Reflection for Chart Reasoning

ChartPoint: 通过 grounding 反射引导 MLLMs 进行图表推理

Zhengzhuo Xu, SiNan Du, Yiyan Qi, SiwenLu, Chengjin Xu, Chun Yuan, Jian Guo

机构 * Tsinghua University(清华大学) International Digital Economy Academy(国际数字经济学院) Beihang University(北航) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 ChartPoint通过引入 grounding 反射机制,提升 MLLMs 在图表推理中的表现,开发了两个指令微调模型,在多个图表基准上取得显著提升。

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏