arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-03-11 至 2026-03-11 共收录 15
2603.09968 2026-03-11 cs.CV

ReCoSplat: Autoregressive Feed-Forward Gaussian Splatting Using Render-and-Compare

ReCoSplat: 基于渲染与比较的自回归前馈高斯点云生成

Freeman Cheng, Botao Ye, Xueting Li, Junqi You, Fangneng Zhan, Ming-Hsuan Yang

机构 * University of California Merced(加州大学默塞德分校) ETH Zurich(苏黎世联邦理工学院) NVIDIA Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 ReCoSplat通过引入渲染与比较模块,解决高斯点云生成中姿态误差问题,实现高效稳定的视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09877 2026-03-11 cs.CV

InternVL-U: Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing

InternVL-U: 使统一多模态模型在理解、推理、生成和编辑方面更加普及

Changyao Tian, Danni Yang, Guanzhou Chen, Erfei Cui, Zhaokai Wang, Yuchen Duan, Penghao Yin, Sitao Chen, Ganlin Yang, Mingxin Liu, Zirun Zhu, Ziqian Fan, Leyao Gu, Haomin Wang, Qi Wei, Jinhui Yin, Xue Yang, Zhihang Zhong, Qi Qin, Yi Xin, Bin Fu, Yihao Liu, Jiaye Ge, Qipeng Guo, Gen Luo, Hongsheng Li, Yu Qiao, Kai Chen, Hongjie Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学) Nanjing University(南京大学) Xiamen University(厦门大学) CUHK MMLab(香港中文大学MMLab)

AI总结 InternVL-U通过轻量级统一多模态模型,在保持强大生成能力的同时,实现了在理解、推理、生成和编辑方面的高效平衡。

Comments technical report, 61 pages, https://github.com/OpenGVLab/InternVL-U

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09716 2026-03-11 cs.AI

AutoAgent: Evolving Cognition and Elastic Memory Orchestration for Adaptive Agents

AutoAgent:为自适应智能体演化认知与弹性记忆编排

Xiaoxing Wang, Ning Liao, Shikun Wei, Chen Tang, Feiyu Xiong

机构 * MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司) Shanghai Jiao Tong University(上海交通大学) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所)

AI总结 AutoAgent通过自我进化多智能体框架,实现动态认知演化与弹性记忆编排,提升智能体在动态环境中的适应性和任务执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09268 2026-03-11 cs.AI

Logos: An evolvable reasoning engine for rational molecular design

Logos:一种可进化推理引擎用于理性分子设计

Haibin Wen, Zhe Zhao, Fanfu Wang, Tianyi Xu, Hao Zhang, Chao Yang, Ye Wei

机构 * City University of Hong Kong(香港城市大学) Lanzhou University(兰州大学) Riltide Medicines(Riltide医药公司) Shanghai Jiao Tong University(上海交通大学)

AI总结 Logos是一种集成多步逻辑推理与严格化学一致性的分子推理模型,通过分阶段训练和化学规则优化,在多个基准数据集上实现了结构准确性和化学有效性上的高性能,同时参数量仅为通用语言模型的几分之一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09251 2026-03-11 stat.ML cs.LG cs.NA math.NA

A Generative Sampler for distributions with possible discrete parameter based on Reversibility

基于可逆性的生成采样器:用于可能具有离散参数分布的采样器

Lei Li, Zhen Wang, Lishuo Zhang

机构 * School of Mathematical Sciences, Shanghai Jiao Tong University, Shanghai, 200240, P.R.China(上海交通大学数学科学学院) Institute of Natural Sciences, MOE-LSC, Shanghai Jiao Tong University, Shanghai, 200240, P.R.China(上海交通大学自然科学研究院)

AI总结 本文提出了一种基于可逆性的生成采样器,适用于具有离散参数分布的复杂系统,通过最小化MMD来实现高效的采样方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09121 2026-03-11 cs.RO cs.AI

DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation

DexHiL: 一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架

Yifan Han, Zhongxi Chen, Yuxuan Zhao, Congsheng Xu, Yanming Shao, Yichuan Peng, Yao Mu, Wenzhao Lian

机构 * CASIA(中国科学院自动化研究所) SJTU(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 DexHiL是一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架,通过干预意识的数据采样策略和轻量级远程操作界面,显著提升了模型在不同任务中的成功率。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02023 2026-03-11 cs.CL

PonderLM-3: Adaptive Token-Wise Pondering with Differentiable Masking

PonderLM-3: 基于可微掩码的自适应逐token pondering

He Li, Feichen Song, Boyi Zeng, Shixiang Song, Zhiqin John Xu, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

AI总结 PonderLM-3通过可微掩码实现token级自适应计算分配,降低预训练困惑度并提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08220 2026-03-11 cs.CL

Pretraining with Token-Level Adaptive Latent Chain-of-Thought

基于令牌级适应性潜在链式思维的预训练

Boyi Zeng, Yiqin Hao, He Li, Shixiang Song, Feichen Song, Zitong Wang, Siyuan Huang, Yi Xu, ZiWei He, Xinbing Wang, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Al Laboratory(上海Al实验室) Sun Yat-sen University(中山大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本研究提出了一种基于令牌级适应性潜在链式思维的预训练方法,通过内部化潜在链式思维来提高模型性能,减少计算成本,并在语言建模和下游任务中取得显著改进。

Comments 15pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02541 2026-03-11 cs.CV

AVGGT: Rethinking Global Attention for Accelerating VGGT

AVGGT:重新思考全局注意以加速VGGT

Xianbing Sun, Zhikai Zhu, Zhengyu Lou, Bo Yang, Jinyang Tang, Liqing Zhang, He Wang, Jianfu Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

AI总结 AVGGT通过将早期全局注意力转换为帧注意力并子采样全局注意力,实现多视图3D任务的加速,同时保持模型精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05875 2026-03-11 cs.SD

LARA-Gen: Enabling Continuous Emotion Control for Music Generation Models via Latent Affective Representation Alignment

LARA-Gen:通过潜在情感表示对齐实现音乐生成模型的连续情绪控制

Jiahao Mei, Xuenan Xu, Zeyu Xie, Zihao Zheng, Ye Tao, Yue Ding, Mengyue Wu

机构 * X-LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai AI Lab, China(上海人工智能实验室) Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine, China(上海交通大学医学院精神卫生中心)

AI总结 LARA-Gen通过潜在情感表示对齐实现音乐生成模型的连续情绪控制,提升情绪可控性和音乐质量。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01068 2026-03-11 cs.RO cs.LG

Compose Your Policies! Improving Diffusion-based or Flow-based Robot Policies via Test-time Distribution-level Composition

制定你的策略!通过测试时的分布级组合改进扩散型或流型机器人策略

Jiahang Cao, Yize Huang, Hanzhong Guo, Rui Zhang, Mu Nan, Weijian Mai, Jiaxu Wang, Hao Cheng, Jingkai Sun, Gang Han, Wen Zhao, Qiang Zhang, Yijie Guo, Qihao Zheng, Chunfeng Song, Xiao Li, Ping Luo, Andrew F. Luo

机构 * The University of Hong Kong(香港大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) Shanghai AI Lab(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本研究提出无需训练的通用策略组合方法,通过测试时分布级组合提升机器人策略性能。

Comments Accepted to ICLR 2026. Project Page: https://sagecao1125.github.io/GPC-Site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01611 2026-03-11 cs.CV cs.AI cs.LG

DRUPI: Dataset Reduction Using Privileged Information

DRUPI: 利用特权信息进行数据集缩减

Shaobo Wang, Youxin Jiang, Tianle Niu, Yantai Yang, Ruiji Zhang, Shuhao Hu, Shuaiyu Zhang, Chenghao Sun, Weiya Li, Conghui He, Xuming Hu, Linfeng Zhang

机构 * EPIC Lab, SJTU(EPIC实验室,上海交通大学) ICBC Shanghai AI Lab(上海人工智能实验室) HKUST(GZ)(香港科技大学(广州))

AI总结 本文提出DCPI方法,通过合成特权信息提升数据集凝练效果,在多个数据集上实现性能提升。

Comments 21 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17135 2026-03-11 cs.CV

TIMotion: Temporal and Interactive Framework for Efficient Human-Human Motion Generation

TIMotion: 时空交互框架用于高效的人机运动生成

Yabiao Wang, Shuo Wang, Jiangning Zhang, Ke Fan, Jiafu Wu, Zhucun Xue, Yong Liu

机构 * Zhejiang University(浙江大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 TIMotion提出一种高效框架,通过因果交互注入、角色演变扫描和局部模式放大,实现高效的人类交互运动生成。

Comments Accepted to CVPR 2025. Project page: https://aigc-explorer.github.io/TIMotion-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08718 2026-03-11 cs.AR cs.AI

CktEvo: Repository-Level RTL Code Benchmark for Design Evolution

CktEvo: 用于设计演化的仓库级RTL代码基准

Zhengyuan Shi, Jingxin Wang, Tairan Cheng, Changran Xu, Weikang Qian, Qiang Xu

机构 * The Chinese University of Hong Kong(中国香港大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 CktEvo提出一个用于仓库级RTL代码演化的基准和框架,通过闭环框架实现PPA改进,无需人工干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06261 2026-03-11 cs.AI cs.CL cs.LG

AlphaApollo: A System for Deep Agentic Reasoning

AlphaApollo:一个深度代理推理系统

Zhanke Zhou, Chentao Cao, Xiao Feng, Xuan Li, Zongze Li, Xiangyu Lu, Jiangchao Yao, Weikai Huang, Tian Cheng, Jianghangfan Zhang, Tangyu Jiang, Linrui Xu, Yiming Zheng, Brando Miranda, Tongliang Liu, Sanmi Koyejo, Masashi Sugiyama, Bo Han

机构 * TMLR Group Department of Computer Science Hong Kong Baptist University(香港 Baptist 大学计算机科学系 TMLR 组) RIKEN AIP Cooperative Medianet Innovation Center Shanghai Jiao Tong University(上海交通大学合作中立创新中心) Stanford University(斯坦福大学) Sydney AI Centre The University of Sydney(悉尼大学悉尼AI中心) The University of Tokyo(东京大学)

AI总结 AlphaApollo通过多轮代理推理、学习和进化机制,提升基础模型在复杂问题解决中的推理能力和工具使用可靠性。

Comments Ongoing project

详情

展开后加载摘要…

URL PDF HTML 收藏