arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

2025-11-21 至 2025-11-21 共收录 6
2511.16573 2025-11-21 cs.OH cs.LG

An Exterior-Embedding Neural Operator Framework for Preserving Conservation Laws

一种用于保持守恒定律的外部嵌入神经算子框架

Huanshuo Dong, Hong Wang, Hao Wu, Zhiwei Zhuang, Xuanze Yang, Ruiqi Shu, Yuan Gao, Xiaomeng Huang

机构 * University of Science and Technology of China(科学技术大学) Tsinghua University(清华大学)

AI总结 本文提出了一种通用的守恒框架,通过外部嵌入技术强制神经算子在预测中严格遵守守恒定律,提升了模型性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16546 2025-11-21 cs.CV

Progressive Supernet Training for Efficient Visual Autoregressive Modeling

渐进式超网络训练用于高效的视觉自回归建模

Xiaoyue Chen, Yuling Shi, Kaiyuan Li, Huandong Wang, Yong Li, Xiaodong Gu, Xinlei Chen, Mingbao Lin

机构 * Tsinghua University, China(清华大学) Shanghai Jiao Tong University, China(上海交通大学) Rakuten, Singapore(Rakuten)

AI总结 VARiant通过渐进式超网络训练实现高效视觉自回归建模,减少内存消耗并提升部署灵活性。

Comments Submitted to CVPR 2025. 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22946 2025-11-21 cs.CV

LightFusion: A Light-weighted, Double Fusion Framework for Unified Multimodal Understanding and Generation

LightFusion: 一种轻量级、双融合框架用于统一多模态理解和生成

Zeyu Wang, Zilong Chen, Chenhui Gou, Feng Li, Chaorui Deng, Deyao Zhu, Kunchang Li, Weihao Yu, Haoqin Tu, Haoqi Fan, Cihang Xie

机构 * UC Santa Cruz(加州大学圣克ruz分校) Tsinghua University(清华大学) Monash University(墨尔本大学) ByteDance Seed Project(字节跳动种子项目)

AI总结 LightFusion通过双融合机制实现轻量级多模态理解和生成,仅用350亿个标记训练即在多个基准测试中取得优异成绩。

Comments Preprint. Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16135 2025-11-21 physics.optics cs.AI

CoSP: Reconfigurable Multi-State Metamaterial Inverse Design via Contrastive Pretrained Large Language Model

CoSP: 通过对比预训练大语言模型实现可重构多状态超材料逆向设计

Shujie Yang, Xuzhe Zhao, Yuqi Zhang, Yansong Tang, Kaichen Dong

机构 * Center of Double Helix, Tsinghua Shenzhen International Graduate School, Tsinghua University(双螺旋中心,清华大学深圳国际研究生院,清华大学) Intelligent Passive Thermal Control Center, Research Institute of Tsinghua University in Shenzhen(智能被动热控制中心,清华大学深圳研究院)

AI总结 CoSP通过对比预训练大语言模型实现可重构多状态超材料的逆向设计,能高效生成具有目标光学性能的材料结构。

Comments 5 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15550 2025-11-21 cs.RO

UltraDP: Generalizable Carotid Ultrasound Scanning with Force-Aware Diffusion Policy

UltraDP: 通用的颈动脉超声扫描与力感知扩散策略

Ruoqu Chen, Xiangjie Yan, Kangchen Lv, Gao Huang, Zheng Li, Xiang Li

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Department of Surgery, Chow Yuk Ho Technology Centre for Innovative Medicine, Li Ka Shing Institute of Health Science and Multi-scale Medical Robotics Center, The Chinese University of Hong Kong, Hong Kong(外科系,创新医学技术中心,利文斯科健康科学研究所及多尺度医学机器人中心,香港中文大学,香港)

AI总结 UltraDP通过力感知扩散策略实现通用颈动脉超声扫描,利用多感官输入和混合控制器提高扫描成功率至95%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13282 2025-11-21 cs.CV

Towards Metric-Aware Multi-Person Mesh Recovery by Jointly Optimizing Human Crowd in Camera Space

通过联合优化人群在摄像空间中的方法实现度量感知的多人体网格恢复

Kaiwen Wang, Kaili Zheng, Yiming Shi, Chenyi Guo, Ji Wu

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) College of AI, Tsinghua University(清华大学人工智能学院) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

AI总结 本文提出度量感知的人体网格恢复方法,通过联合优化多人在摄像空间中的位置,提升场景一致性与恢复精度。

详情

展开后加载摘要…

URL PDF HTML 收藏