arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-02-24 至 2026-02-24 共收录 17
2602.19753 2026-02-24 cs.CV cs.GR

RAP: Fast Feedforward Rendering-Free Attribute-Guided Primitive Importance Score Prediction for Efficient 3D Gaussian Splatting Processing

RAP: 快速前馈渲染-free 属性引导的原始形体重要性分数预测用于高效3D高斯点绘处理

Kaifa Yang, Qi Yang, Yiling Xu, Zhu Li

机构 * Shanghai Jiao Tong University(上海交通大学) University of Missouri–Kansas City(密苏里大学-堪萨斯城分校)

AI总结 RAP通过属性引导和高效算法,实现3DGS中原始形体重要性分数的快速预测,提升重建、压缩和传输效率。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19735 2026-02-24 cs.CV

VGGT-MPR: VGGT-Enhanced Multimodal Place Recognition in Autonomous Driving Environments

VGGT-MPR:基于VGGT的多模态地点识别在自动驾驶环境中的应用

Jingyi Xu, Zhangshuo Qi, Zhongmiao Yan, Xuyu Gao, Qianyun Jiao, Songpengcheng Xia, Xieyuanli Chen, Ling Pei

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) National University of Defense Technology(国防科技大学)

AI总结 VGGT-MPR通过视觉几何基础的Transformer实现多模态地点识别,在自动驾驶中表现出强鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19536 2026-02-24 cs.CV cs.AI

Fore-Mamba3D: Mamba-based Foreground-Enhanced Encoding for 3D Object Detection

Fore-Mamba3D:基于Mamba的前景增强编码用于3D目标检测

Zhiwei Ning, Xuanang Gao, Jiaxi Cao, Runze Yang, Huiying Xu, Xinzhong Zhu, Jie Yang, Wei Liu

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Institute of Image Processing and Pattern Recognition, Shanghai Jiao Tong University(上海交通大学图像处理与模式识别研究所) Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) School of Computer Science and Technology, Zhejiang Normal University(浙江师范大学计算机科学与技术学院) Beijing Geekplus Technology Co., Ltd(北京 Geekplus 技术有限公司)

AI总结 Fore-Mamba3D通过改进Mamba编码器实现前景增强,解决3D目标检测中响应衰减和上下文表示不足的问题,提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19523 2026-02-24 cs.CV

OSInsert: Towards High-authenticity and High-fidelity Image Composition

OSInsert: 向高真实性与高保真图像合成迈进

Jingyuan Wang, Li Niu

机构 * MoE Key Lab of Artificial Intelligence(人工智能关键实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 OSInsert提出一种两阶段策略,通过先生成合理前景形状再保留细节,实现高真实性与高保真的图像合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19225 2026-02-24 cs.AI

Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training

基于接近性的多轮优化:LLM代理训练中的实用信用分配

Yangyi Fang, Jiaye Lin, Xiaoliang Fu, Cong Qin, Haolin Shi, Chang Liu, Peilin Zhao

机构 * Tsinghua University(清华大学) Fudan University(复旦大学) Peking University(北京大学) Lanzhou University(兰州大学) Tencent Inc.(腾讯公司) Shanghai Jiao Tong University(上海交通大学)

AI总结 ProxMO通过动态调整梯度强度和连续语义加权,提升LLM代理在多轮训练中的信用分配效率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19178 2026-02-24 cs.CV

EMAD: Evidence-Centric Grounded Multimodal Diagnosis for Alzheimer's Disease

EMAD: 基于证据的多模态诊断框架用于阿尔茨海默病

Qiuhui Chen, Xuancheng Yao, Zhenglei Zhou, Xinyue Hu, Yi Hong

机构 * East China University of Science and Technology(东华大学) Shanghai Jiao Tong University(上海交通大学) Tencent(腾讯)

AI总结 EMAD通过多模态证据接地机制,生成结构化诊断报告,提升阿尔茨海默病诊断的透明度和临床一致性。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14512 2026-02-24 cs.CV

MedVAR: Towards Scalable and Efficient Medical Image Generation via Next-scale Autoregressive Prediction

MedVAR:通过下一步尺度自回归预测实现可扩展和高效的医学图像生成

Zhicheng He, Yunpeng Zhao, Junde Wu, Ziwei Niu, Zijun Li, Bohan Li, Lanfen Lin, Yueming Jin

机构 * National University of Singapore(新加坡国立大学) University of Oxford(牛津大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 MedVAR通过下一步尺度自回归预测方法,实现了高效且可扩展的医学图像生成,为医学生成基础模型提供了新的方向。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14208 2026-02-24 cs.LG math.OC stat.ML

Fast Catch-Up, Late Switching: Optimal Batch Size Scheduling via Functional Scaling Laws

快速追上,后期切换:通过函数缩放定律进行最优批量大小调度

Jinbo Wang, Binghui Li, Zhanpeng Zhou, Mingze Wang, Yuxuan Sun, Jiaqi Zhang, Xunliang Cai, Lei Wu

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Center for Machine Learning Research, Peking University(北京大学机器学习研究中心) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(中国科学技术大学认知智能国家重点实验室) Meituan, Beijing(美团(北京)) AI for Science Institute, Beijing(北京人工智能科学研究院)

AI总结 本文通过函数缩放定律揭示了大规模深度学习中最优批量大小调度的理论机制,表明在困难任务中后期切换大批次可提升效率并减少数据消耗。

Comments 34 pages, accepted by ICLR 2026 as a conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16175 2026-02-24 cs.CV cs.AI

Mantis: A Versatile Vision-Language-Action Model with Disentangled Visual Foresight

Mantis:一种具有解耦视觉前瞻性能力的多功能视觉-语言-动作模型

Yi Yang, Xueqi Li, Yiyang Chen, Jin Song, Yihan Wang, Zipeng Xiao, Jiadi Su, You Qiaoben, Pengfei Liu, Zhijie Deng

机构 * SJTU(上海交通大学) SII(上海信息所) SUSTech(四川大学) NJUPT(南京工业大学) FDU(福建大学) BOSCH(博世)

AI总结 Mantis通过解耦视觉前瞻性模块提升视觉-语言-动作模型的性能,实现高成功率和快速收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25232 2026-02-24 cs.AI cs.CL

From Medical Records to Diagnostic Dialogues: A Clinical-Grounded Approach and Dataset for Psychiatric Comorbidity

从医疗记录到诊断对话:一种基于临床的途径和数据集用于精神疾病共病

Tianxi Wan, Jiaming Luo, Siyuan Chen, Kunyao Lan, Jianhua Chen, Haiyang Geng, Mengyue Wu

机构 * X - LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai Mental Health Center, SJTU School of Medicine, China(上海精神卫生中心,上海交通大学医学院) Chen Frontier Lab for AI and Mental Health, Tianqiao and Chrissy Chen Institute, Shanghai, China(陈前沿人工智能与心理健康实验室,田青和克里斯蒂娜·陈研究所)

AI总结 本文提出了一种基于临床的途径和数据集,用于生成支持精神疾病共病的多轮诊断对话,通过合成患者电子医疗记录和多智能体对话生成技术,构建了首个大规模对话数据集PsyCoTalk,提升了诊断准确性和治疗计划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18920 2026-02-24 cs.CL cs.AI

DeepInnovator: Triggering the Innovative Capabilities of LLMs

DeepInnovator: 激发大语言模型的创新能力

Tianyu Fan, Fengji Zhang, Yuxiang Zheng, Bei Chen, Xinyao Niu, Chengen Huang, Junyang Lin, Chao Huang

机构 * The University of Hong Kong(香港大学) City University of Hong Kong(城市大学) Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 DeepInnovator通过自动化数据提取和猜想与反驳训练范式,提升大语言模型的创新能力,实现显著优于基线的创新想法生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18773 2026-02-24 cs.AI

LAMMI-Pathology: A Tool-Centric Bottom-Up LVLM-Agent Framework for Molecularly Informed Medical Intelligence in Pathology

LAMMI-Pathology: 一种以工具为中心的自下而上LVLM-智能体框架用于分子信息引导的病理学智能

Haoyang Su, Shaoting Zhang, Xiaosong Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 LAMMI-Pathology提出了一种以工具为中心的自下而上智能体框架,通过分子信息引导的病理学智能提升病理图像分析的证据驱动能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18697 2026-02-24 cs.CV

Deep LoRA-Unfolding Networks for Image Restoration

深度 LoRA 展开网络用于图像恢复

Xiangming Wang, Haijin Zeng, Benteng Sun, Jiezhang Cao, Kai Zhang, Qiangqiang Shen, Yongyong Chen

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳)) Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(图像通信与网络工程院,上海交通大学) School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学) School of Electronics and Information Engineering, Harbin Institute of Technology (Shenzhen)(电子与信息工程学院,哈尔滨工业大学(深圳))

AI总结 LoRun 通过引入 LoRA 适配器实现高效图像恢复,减少参数冗余并提升去噪性能。

Comments Accepted by IEEE Transactions on Image Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07854 2026-02-24 cs.CV

Geometry-Aware Rotary Position Embedding for Consistent Video World Model

面向一致视频世界模型的几何感知旋转位置嵌入

Chendong Xiang, Jiajun Liu, Jintao Zhang, Xiao Yang, Zhengwei Fang, Shizun Wang, Zijun Wang, Yingtian Zou, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(清华大学计算机科学与技术系、人工智能研究院、BNRist中心、THBI实验室、清华-博世联合机器学习中心、清华大学) Gaoling School of Artificial Intelligence, Renmin University of China(北京人民大学人工智能学院) National University of Singapore(新加坡国立大学) Peking University(北京大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 本文提出ViewRope和几何感知帧稀疏注意力,通过引入相机射线方向提升视频世界模型的长期一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20648 2026-02-24 cs.LG cs.RO

Wonder Wins Ways: Curiosity-Driven Exploration through Multi-Agent Contextual Calibration

Wonder Wins Ways: 通过多智能体上下文校准实现好奇心驱动的探索

Yiyuan Pan, Zhe Liu, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) School of Automation and Intelligent Sensing(自动化与智能感知学院) Key Laboratory of System Control and Information Processing(系统控制与信息处理重点实验室) Ministry of Education of China(中华人民共和国教育部) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家级重点实验室) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)

AI总结 CERMIC通过多智能体上下文校准增强探索,解决稀疏奖励环境下多智能体强化学习的探索效率问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08134 2026-02-24 cs.CV

Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control

跟随你的形状:通过轨迹引导的区域控制实现形状感知图像编辑

Zeqian Long, Mingzhe Zheng, Kunyu Feng, Xinhua Zhang, Hongyu Liu, Harry Yang, Linfeng Zhang, Qifeng Chen, Yue Ma

机构 * HKUST(香港科技大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Shanghai Jiao Tong University(上海交通大学)

AI总结 Follow-Your-Shape通过轨迹引导的区域控制实现精准形状编辑,无需训练和掩码,提升大规模形状变换任务的编辑性和视觉保真度。

Comments Accepted to ICLR 2026. Project webpage is available at https://follow-your-shape.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02066 2026-02-24 cs.LG cs.AI cs.CL

MolReasoner: Toward Effective and Interpretable Reasoning for Molecular LLMs

MolReasoner:迈向分子大语言模型的有效且可解释的推理

Guojiang Zhao, Zixiang Lu, Yutang Ge, Sihang Li, Zheng Cheng, Haitao Lin, Lirong Wu, Hanchen Xia, Hengxing Cai, Wentao Guo, Hongshuai Wang, Mingjun Xu, Siyu Zhu, Guolin Ke, Linfeng Zhang, Zhifeng Gao

机构 * DP Technology, Beijing, China(DP技术有限公司) AI for Science Institute, Beijing, China(AI for Science研究院) Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Fudan University, Shanghai, China(复旦大学)

AI总结 MolReasoner通过两阶段框架提升分子大语言模型的推理能力和可解释性,有效减少幻觉并提高生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏