Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
通过真实世界室内游览视频的多模态事件知识增强视觉语言导航
Haoxuan Xu, Tianfu Li, Wenbo Chen, Yi Liu, Xingxing Zuo, Yaoxian Song, Haoang Li
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Tsinghua University(清华大学)
;
Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(马尔代夫 bin Zayed 大学人工智能学院)
;
Hangzhou City University(杭州城市学院)
机构
*
School of Mathematics, Hefei University of Technology(合肥工业大学数学学院)
;
School of Software, Tsinghua University(清华大学软件学院)
;
School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)
Unified Biomolecular Trajectory Generation via Pretrained Variational Bridge
通过预训练变分桥统一生物分子轨迹生成
Ziyang Yu, Wenbing Huang, Yang Liu
机构
*
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
Gaoling School of Artificial intelligence, Renmin University of China(中国人民大学北京学院人工智能学院)
RE-PO: Robust Enhanced Policy Optimization as a General Framework for LLM Alignment
RE-PO:一种用于大语言模型对齐的鲁棒增强策略优化通用框架
Xiaoyang Cao, Zelai Xu, Mo Guang, Kaiwen Long, Michiel A. Bakker, Yu Wang, Chao Yu
机构
*
IDSS, Massachusetts Institute of Technology(IDSS,麻省理工学院)
;
EE, Tsinghua University(电子工程系,清华大学)
;
Li Auto Inc.(力汽车公司)
;
SIGS, Tsinghua University(系统工程系,清华大学)
Quantum Learning and Estimation for Coordinated Operation between Distribution Networks and Energy Communities
分布式网络与能源社区协调运行中的量子学习与估计
Yingrui Zhuang, Lin Cheng, Yuji Cao, Tongxin Li, Ning Qi, Yan Xu, Yue Chen
机构
*
Department of Electrical Engineering, Tsinghua University(清华大学电子工程系)
;
Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系)
;
School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学深圳校区数据科学学院)
;
Department of Earth and Environmental Engineering, Columbia University(哥伦比亚大学地球与环境工程系)
;
School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)
Stereo-Talker: Audio-driven 3D Human Synthesis with Prior-Guided Mixture-of-Experts
立体说话者:基于优先级的混合专家引导的音频驱动3D人类合成
Xiang Deng, Youxin Pang, Xiaochen Zhao, Chao Xu, Lizhen Wang, Hongjiang Xiao, Shi Yan, Hongwen Zhang, Yebin Liu
机构
*
Department of Automation, Tsinghua University(自动化系,清华大学)
;
Bytedance Inc.(字节跳动公司)
;
State Key Laboratory of Media Convergence and Communication, Communication University of China(媒体融合与传播国家重点实验室,中国传媒大学)
;
School of Artificial Intelligence, Beijing Normal University(人工智能学院,北京师范大学)
TIGER: Time-frequency Interleaved Gain Extraction and Reconstruction for Efficient Speech Separation
TIGER:用于高效语音分离的时间-频率交织增益提取与重建
Mohan Xu, Kai Li, Guo Chen, Xiaolin Hu
机构
*
Department of Computer Science and Technology, Institute for AI, BNRist, Tsinghua University(计算机科学与技术系、人工智能研究院、BNRist、清华大学)
;
Tsinghua Laboratory of Brain and Intelligence (THBI), IDG/McGovern Institute for Brain Research, Tsinghua University(脑智能实验室(THBI)、IDG/麦克戈文脑科学研究院、清华大学)
;
Chinese Institute for Brain Research (CIBR), Beijing(中国脑科学研究院)