arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2025-12-17 至 2025-12-17 共收录 11
2512.14692 2025-12-17 cs.CV cs.AI

Native and Compact Structured Latents for 3D Generation

原生且紧凑的结构化潜在变量用于3D生成

Jianfeng Xiang, Xiaoxue Chen, Sicheng Xu, Ruicheng Wang, Zelong Lv, Yu Deng, Hongyuan Zhu, Yue Dong, Hao Zhao, Nicholas Jing Yuan, Jiaolong Yang

机构 * Tsinghua University(清华大学) Microsoft Research(微软研究院) USTC(University of Science and Technology of China) Microsoft AI(微软人工智能)

AI总结 本文提出O-体素和稀疏压缩变分自编码器,通过高效生成高质量3D资产,推动3D生成建模的发展。

Comments Project Page: https://microsoft.github.io/TRELLIS.2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14619 2025-12-17 cs.LG

ParaFormer: A Generalized PageRank Graph Transformer for Graph Representation Learning

ParaFormer: 一种通用的PageRank图变换器用于图表示学习

Chaohao Yuan, Zhenjie Song, Ercan Engin Kuruoglu, Kangfei Zhao, Yang Liu, Deli Zhao, Hong Cheng, Yu Rong

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The Chinese University of Hong Kong(香港中文大学) DAMO Academy, Alibaba Group, Hupan Lab(达摩院、阿里集团、乎盘实验室)

AI总结 ParaFormer通过PageRank增强的注意力模块缓解深度GNNs中的过平滑问题,实现节点和图分类任务的性能提升。

Comments Accepted by WSDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14499 2025-12-17 cs.CV

Native Intelligence Emerges from Large-Scale Clinical Practice: A Retinal Foundation Model with Deployment Efficiency

原生智能源自大规模临床实践:一种具有部署效率的视网膜基础模型

Jia Guo, Jiawei Du, Shengzhu Yang, Shuai Lu, Wenquan Cheng, Kaiwen Zhang, Yihua Sun, Chuhong Yang, Weihang Zhang, Fang Chen, Yilan Wu, Lie Ju, Guochen Ning, Longfei Ma, Huiping Yao, Jinyuan Wang, Peilun Shi, Yukun Zhou, Jie Xu, Pearse A. Keane, Hanruo Liu, Hongen Liao, Ningli Wang, Huiqi Li

机构 * School of Biomedical Engineering, Tsinghua Medicine, Tsinghua University(生物医学工程学院,清华大学医学部,清华大学) School of Information and Electronics, Beijing Institute of Technology(信息与电子学院,北京理工大学) Beijing Key Laboratory of Intelligent Diagnosis Technology and Equipment for Optic Nerve-Related Eye Diseases(北京智能诊断技术与设备重点实验室) School of Medical Technology, Beijing Institute of Technology(医学技术学院,北京理工大学) Beijing Tongren Hospital, Capital Medical University(北京同仁医院,首都医科大学) School of Biomedical Engineering, Shanghai Jiaotong University(生物医学工程学院,上海交通大学) Beijing Visual Science and Translational Eye Research Institute (BERI), Beijing Tsinghua Changgung Hospital Eye Center, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University Institute of Ophthalmology(北京视觉科学与转化眼研所(BERI),北京清华长庚医院眼科中心,临床医学学院,清华大学医学部,清华大学眼科学院)

AI总结 ReVision通过直接从真实临床数据中学习,实现了在低资源环境下高效部署的视网膜基础模型,无需额外标注即可在多种医学任务中取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14352 2025-12-17 cs.CV cs.CG

HGS: Hybrid Gaussian Splatting with Static-Dynamic Decomposition for Compact Dynamic View Synthesis

HGS: 基于静态-动态分解的混合高斯散射用于紧凑动态视图合成

Kaizhe Zhang, Yijie Zhou, Weizhan Zhang, Caixia Yan, Haipeng Du, yugui xie, Yu-Hui Wen, Yong-Jin Liu

机构 * Xi’an Jiaotong University(西安交通大学) Beijing Jiaotong University(北京交通大学) Tsinghua University(清华大学)

AI总结 HGS通过静态-动态分解策略,实现高效动态视图合成,减少模型体积并提升渲染效率。

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14291 2025-12-17 cs.SD

GLM-TTS Technical Report

GLM-TTS 技术报告

Jiayan Cui, Zhihan Yang, Naihan Li, Jiankun Tian, Xingyu Ma, Yi Zhang, Guangyu Chen, Runxuan Yang, Yuqing Cheng, Yizhi Zhou, Guochen Yu, Xiaotao Gu, Jie Tang

机构 * Zhipu AI(智谱AI) Tsinghua University(清华大学)

AI总结 GLM-TTS通过优化的语音分词器和多奖励强化学习框架,实现高效可控的生产级语音生成系统,同时支持参数高效定制和混合输入方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14068 2025-12-17 cs.CV cs.AI

SDAR-VL: Stable and Efficient Block-wise Diffusion for Vision-Language Understanding

SDAR-VL: 稳定且高效的块状扩散用于视觉语言理解

Shuang Cheng, Yuhua Jiang, Zineng Zhou, Dawei Liu, Wang Tao, Linfeng Zhang, Biqing Qi, Bowen Zhou

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) ByteDance(字节跳动)

AI总结 SDAR-VL通过高效的块状扩散方法,在视觉语言理解中实现了更高的训练效率、收敛稳定性及任务性能,优于传统块扩散并匹敌强AR基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13716 2025-12-17 cs.AI

ValuePilot: A Two-Phase Framework for Value-Driven Decision-Making

ValuePilot:一种面向价值驱动决策的双阶段框架

Yitong Luo, Ziang Chen, Hou Hei Lam, Jiayu zhan, Junqi Wang, Zhenliang Zhang, Xue Feng

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(1 通用人工智能国家重点实验室,BIGAI) Tsinghua University(2 清华大学) Peking University(3 北京大学)

AI总结 ValuePilot通过双阶段框架实现价值驱动的个性化决策,提升AI在复杂场景中的可解释性和适应性。

Comments Accepted at LAW Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04540 2025-12-17 cs.CV

VideoMem: Enhancing Ultra-Long Video Understanding via Adaptive Memory Management

VideoMem: 通过自适应内存管理增强超长视频理解

Hongbo Jin, Qingyuan Wang, Wenhao Zhang, Yang Liu, Sijie Cheng

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学) Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学)

AI总结 VideoMem通过自适应内存管理框架,有效提升超长视频理解任务的性能,采用PRPO算法和两个核心模块实现高效训练和长期记忆保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00981 2025-12-17 cs.CV

VesSAM: Efficient Multi-Prompting for Segmenting Complex Vessel

VesSAM: 高效多提示分割复杂血管

Suzhong Fu, Rui Sun, Xuan Ding, Jingqi Dong, Yiming Yang, Yao Zhu, Min Chang Jordan Ren, Delin Deng, Angelica Aviles-Rivero, Shuguang Cui, Zhen Li

机构 * FNii-Shenzhen, CUHK-Shenzhen(FNii-Shenzhen,CUHK-Shenzhen) School of Science and Engineering, CUHK-Shenzhen(CUHK-Shenzhen科学与工程学院) Zhejiang University(浙江大学) Boston University(波士顿大学) Vanderbilt University(范德比大学) Tsinghua University(清华大学)

AI总结 VesSAM通过多提示编码器和轻量级解码器提升血管分割性能,实现比现有方法更高的Dice和IoU指标,同时参数更少且泛化能力更强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07584 2025-12-17 cs.LG

MIRA: Medical Time Series Foundation Model for Real-World Health Data

MIRA:面向真实世界健康数据的医学时间序列基础模型

Hao Li, Bowen Deng, Chang Xu, Zhiyuan Feng, Viktor Schlegel, Yu-Hao Huang, Yizheng Sun, Jingyuan Sun, Kailai Yang, Yiyao Yu, Jiang Bian

机构 * Microsoft Research(微软研究院) University of Manchester(曼彻斯特大学) Peking University(北京大学) Tsinghua University(清华大学) Nanjing University(南京大学) Imperial Global Singapore, Imperial College London(帝国理工学院伦敦分校)

AI总结 MIRA是一种专为医学时间序列预测设计的基础模型,通过连续时间旋转位置编码、频率特定混合专家层和连续动态外推块,实现对不规则时间间隔、异质采样率和缺失值的高效处理,提升医疗时间序列数据的预测精度和跨机构迁移能力。

Comments NeurIPS 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17900 2025-12-17 cs.LG

Shared DIFF Transformer

共享DIFF变换器

Yueyang Cang, Yuhang Liu, Xiaoteng Zhang, Li Shi, Wenge Que

机构 * Tsinghua University, Beijing, China(清华大学) Donghua University, Shanghai, China(东华大学)

AI总结 共享DIFF变换器通过引入共享基矩阵和低秩更新,减少参数冗余并提升效率,实现更优的噪声抑制和任务适应性。

Comments arXiv admin note: text overlap with arXiv:2501.17486

详情

展开后加载摘要…

URL PDF HTML 收藏