arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-04-15 至 2026-04-15 共收录 16
2604.12968 2026-04-15 cs.LG cs.CV

Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations

优化方法的演变:算法、场景与评估

Tong Zhang, Jiangning Zhang, Zhucun Xue, Juntao Jiang, Yicheng Xu, Chengming Xu, Teng Hu, Xingyu Xie, Xiaobin Hu, Yabiao Wang, Yong Liu, Shuicheng Yan

机构 * Zhejiang University(浙江大学) APRIL Lab(APRIL实验室) Fudan University(复旦大学) Shanghai Jiaotong University(上海交通大学) National University of Singapore(新加坡国立大学)

AI总结 本文回顾了深度学习优化算法的演变历程,通过广泛实验评估主流优化器在不同模型架构和训练场景中的表现,揭示了新兴趋势与核心设计权衡,为未来高效、可靠优化方法的设计提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12916 2026-04-15 cs.RO

E2E-Fly: An Integrated Training-to-Deployment System for End-to-End Quadrotor Autonomy

E2E-Fly:一种端到端四旋翼自主性的集成训练到部署系统

Fangyu Sun, Fanxing Li, Linzuo Zhang, Yu Hu, Renbiao Jin, Shuyu Wu, Wenxian Yu, Danping Zou

机构 * School of Automation and Perception, Shanghai Jiao Tong University(自动化与感知学院,上海交通大学)

AI总结 本文提出E2E-Fly系统,整合了高效模拟器与强化学习,通过两阶段验证策略和仿真到现实对齐方法,实现四旋翼自主控制的端到端训练与部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12904 2026-04-15 cs.CV

A Sanity Check on Composed Image Retrieval

对组合图像检索的检验

Yikun Liu, Jiangchao Yao, Weidi Xie, Yanfeng Wang

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, China(上海交通大学人工智能学院, 上海交通大学, 中国) CMIC, Shanghai Jiao Tong University, China(上海交通大学计算机信息中心, 上海交通大学, 中国)

AI总结 本文提出FISD基准和多轮代理评估框架,通过精确控制图像变量和交互场景,提升组合图像检索方法的评估准确性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12709 2026-04-15 cs.LG cs.AI cs.CV

Information-Theoretic Optimization for Task-Adapted Compressed Sensing Magnetic Resonance Imaging

信息论优化用于任务适应的压缩感知磁共振成像

Xinyu Peng, Ziyang Zheng, Wenrui Dai, Duoduo Xue, Shaohui Li, Chenglin Li, Junni Zou, Hongkai Xiong

机构 * Department of Computer Science and Engineering, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系) Department of Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子工程系) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)

AI总结 本文提出基于信息论的任务适应压缩感知磁共振成像方法,通过最大化未采样k空间测量与临床任务间的互信息,实现不确定性预测和适应任意采样比率的灵活控制。

Comments 68 pages, 15 figures, accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21990 2026-04-15 cs.CE cs.AI

ChemDFM-R: A Chemical Reasoning LLM Enhanced with Atomized Chemical Knowledge

ChemDFM-R: 一种增强原子化化学知识的化学推理大语言模型

Zihan Zhao, Ziping Wan, Lu Chen, Xuanze Lin, Shiyang Yu, Situo Zhang, Da Ma, Zichen Zhu, Danyang Zhang, Huayang Wang, Zhongyang Dai, Liyang Wen, Bo Chen, Xin Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室、计算机科学学院、上海交通大学、上海、中国) Suzhou Laboratory, Suzhou, China(苏州实验室、苏州、中国) Shanghai Innovation Institution, Shanghai, China(上海创新研究院、上海、中国) Jiangsu Key Lab of Language Computing, Suzhou, China(江苏省语言计算重点实验室、苏州、中国) School of Chemistry and Chemical Engineering, Shanghai Jiao Tong University, Shanghai, China(化学与化工学院、上海交通大学、上海、中国)

AI总结 本文提出ChemDFM-R,通过构建原子化化学知识库ChemFG并采用混合源蒸馏方法,提升模型对化学原理和反应逻辑的理解,实现优于通用和领域大模型的化学推理能力。

Comments 20 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05206 2026-04-15 cs.CR cs.AI cs.CL cs.CV

Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety

大规模安全:大型模型和智能体安全的全面综述

Xingjun Ma, Yifeng Gao, Yixu Wang, Ruofan Wang, Xin Wang, Ye Sun, Yifan Ding, Hengyuan Xu, Yunhao Chen, Yunhan Zhao, Hanxun Huang, Yige Li, Yutao Wu, Jiaming Zhang, Xiang Zheng, Yang Bai, Zuxuan Wu, Xipeng Qiu, Jingfeng Zhang, Yiming Li, Xudong Han, Haonan Li, Jun Sun, Cong Wang, Jindong Gu, Baoyuan Wu, Siheng Chen, Tianwei Zhang, Yang Liu, Mingming Gong, Tongliang Liu, Shirui Pan, Cihang Xie, Tianyu Pang, Yinpeng Dong, Ruoxi Jia, Yang Zhang, Shiqing Ma, Xiangyu Zhang, Neil Gong, Chaowei Xiao, Sarah Erfani, Tim Baldwin, Bo Li, Masashi Sugiyama, Dacheng Tao, James Bailey, Yu-Gang Jiang

机构 * Fudan University(复旦大学) The University of Melbourne(墨尔本大学) Singapore Management University(新加坡国立大学) Deakin University(德肯大学) Hong Kong University of Science and Technology(香港科学与技术大学) City University of Hong Kong(香港城市大学) University of Oxford(牛津大学) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) The University of Sydney(悉尼大学) Griffith University(格里菲斯大学) University of California, Santa Cruz(加州大学圣克鲁兹分校) Sea AI Lab(Sea AI实验室) Tsinghua University(清华大学) Virginia Tech(弗吉尼亚理工大学) CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全部) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) Purdue University(普渡大学) Duke University(杜克大学) University of Wisconsin - Madison(威斯康星大学麦迪逊分校) RIKEN(理化学研究所) The University of Tokyo(东京大学)

AI总结 本文综述了大型模型和智能体的安全性,分析了各类攻击威胁及防御策略,指出安全评估、防御机制和数据实践的重要性,强调研究社区和国际合作的必要性。

Comments 706 papers, 60 pages, 3 figures, 14 tables; GitHub: https://github.com/xingjunm/Awesome-Large-Model-Safety

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12502 2026-04-15 cs.CV cs.AI

SEATrack: Simple, Efficient, and Adaptive Multimodal Tracker

SEATrack: 简单、高效且自适应的多模态跟踪器

Junbin Su, Ziteng Xue, Shihui Zhang, Kun Chen, Weiming Hu, Zhipeng Zhang

机构 * School of Artificial Intelligence (School of Software), Yanshan University(燕山大学人工智能学院(软件学院)) School of Software, Beihang University(北航软件学院) Hebei Key Laboratory of Computer Virtual Technology and System Integration(河北省计算机虚拟技术与系统集成重点实验室) State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), CASIA(多模态人工智能系统国家重点实验室(MAIS),CASIA) School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院) AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院自动化实验室)

AI总结 SEATrack通过跨模态对齐和层次混合专家机制,在RGB-T、RGB-D和RGB-E跟踪任务中实现性能与效率的平衡。

Comments Accepted as a CVPR 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12413 2026-04-15 physics.flu-dyn cs.RO

Learning step-level dynamic soaring in shear flow

在风切变流中学习步级动态滑翔

Lunbing Chen, Jixin Lu, Yufei Yin, Jinpeng Huang, Yang Xiang, Hong Liu

机构 * J.C.Wu Center for Aerodynamics, School of Aeronautics and Astronautics, Shanghai Jiao Tong University(J.C.Wu 动力学中心,航空与航天学院,上海交通大学)

AI总结 本文通过深度强化学习展示在无风切变流中无需显式轨迹规划,仅通过局部感知即可实现稳健的全方位导航,揭示了动态滑翔的反馈控制结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12385 2026-04-15 cs.CL

From Myopic Selection to Long-Horizon Awareness: Sequential LLM Routing for Multi-Turn Dialogue

从短视选择到长周期意识:面向多轮对话的序列LLM路由

Jiarui Zhang, Xiangyu Liu, Yong Hu, Chaoyue Niu, Hang Zeng, Shaojie Tang, Fan Wu, Guihai Chen

机构 * School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院) WeChat, Tencent Inc, Beijing, China(腾讯北京研发中心) University at Buffalo, New York, United States(布法罗大学)

AI总结 本文提出DialRouter,通过MCTS探索对话分支并学习轻量路由策略,实现多轮对话的高效路由,提升任务成功率并优化性能成本比。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12162 2026-04-15 cs.CL

AlphaEval: Evaluating Agents in Production

AlphaEval:生产环境中的代理评估

Pengrui Lu, Bingyu Xu, Wenjun Zhang, Shengjia Hua, Xuanjian Gao, Ranxiang Ge, Lyumanshan Ye, Linxuan Wu, Yiran Li, Junfei Fish Yu, Yibo Zhang, Ruixin Li, Manxiang Li, Xiao Han, Xiaocong Zhou, Guangyao Chi, Zisheng Chen, Kaishen Chen, Kun Wang, Qihua Xu, Fengyue Meng, Yuchen Ni, Jiajun Li, Jinxiu Liu, Danfeng Zhang, Jingru Zhao, Pengfei Liu

机构 * SII MiraclePlus SJTU(上海交通大学) GAIR HIT(哈尔滨工业大学) UCAS(中国科学技术大学) LangCore Jiqizhixin HunterAI CinoCore KuaFuAI POET

AI总结 AlphaEval 是一个基于生产环境的评估基准,包含 94 个任务,涵盖六个职业领域,通过多种评估方法评估完整代理产品,提供可复现的构建框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09121 2026-04-15 cs.CL cs.AI cs.SD

Interactive ASR: Towards Human-Like Interaction and Semantic Coherence Evaluation for Agentic Speech Recognition

交互式语音识别:迈向人样交互和语义连贯性评估的代理语音识别

Peng Wang, Yanqiao Zhu, Zixuan Jiang, Qinyuan Chen, Xingjian Zhao, Xipeng Qiu, Wupeng Wang, Zhifu Gao, Xiangang Li, Kai Yu, Xie Chen

机构 * X-LANCE Lab, Shanghai Jiao Tong University(上海交通大学X-LANCE实验室) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Xi'an Jiaotong University(西安交通大学) Fudan University(复旦大学) Tongyi Fun Team, Alibaba Group(阿里巴巴集团 Tongyi 团队)

AI总结 本文提出基于LLM的代理框架,通过语义反馈提升语音识别的语义准确性和交互修正能力,实验验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23061 2026-04-15 cs.IR cs.AI cs.CL cs.DB cs.LG

MoDora: Tree-Based Semi-Structured Document Analysis System

MoDora:基于树的半结构化文档分析系统

Bangrui Xu, Qihang Yao, Zirui Tang, Xuanhe Zhou, Yeye He, Shihan Yu, Qianqian Xu, Bin Wang, Guoliang Li, Conghui He, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Microsoft Research(微软研究院) Beihang University(北航) Shanghai AI Lab(上海人工智能实验室) Tsinghua University(清华大学) Institute for Clarity in Documentation(文档清晰性研究所) Inria Paris-Rocquencourt(Inria巴黎-罗quentcourt研究中心) East China Normal University(华东师范大学) Scientific Writing Academy(科学写作学院)

AI总结 MoDora通过局部对齐聚合策略和组件相关树结构,提升半结构化文档的分析能力,实验表明其在准确性上优于基线方法。

Comments Extension of our SIGMOD 2026 paper. Please refer to source code available at https://github.com/weAIDB/MoDora

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00412 2026-04-15 cs.CR cs.AI

Red Teaming Large Reasoning Models

对大型推理模型进行红队测试

Jiawei Chen, Yang Yang, Chao Yu, Yu Tian, Zhi Cao, Xue Yang, Linghao Li, Hang Su, Zhaoxia Yin

机构 * Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University(上海多维信息处理关键实验室,东华大学) Zhongguancun Academy(中关村学院) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Dept. of Comp. Sci. and Tech., THBI Lab, Tsinghua University(计算机科学与技术系,清华THBI实验室) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出RT-LRM基准,评估大型推理模型的可信度,揭示其在面对推理风险时的脆弱性,并发布工具箱支持未来研究。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09087 2026-04-15 cs.AI

The Stackelberg Speaker: Optimizing Persuasive Communication in Social Deduction Games

Stackelberg发言者:优化社会推断游戏中的说服性沟通

Zhang Zheng, Deheng Ye, Peilin Zhao, Hao Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tencent(腾讯) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出基于Stackelberg竞争的强化学习框架,用于优化社会推断游戏中说服性沟通,通过实验展示其在三种不同游戏中的优越性。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19742 2026-04-15 cs.CL cs.AI cs.IR

HiCoLoRA: Addressing Context-Prompt Misalignment via Hierarchical Collaborative LoRA for Zero-Shot DST

HiCoLoRA:通过分层协作LoRA解决上下文提示对齐问题

Shuyu Zhang, Yifan Wei, Xinru Wang, Yanmin Zhu, Yangfan He, Yixuan Weng, Bin Li, Yujie Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学) University of Sydney(悉尼大学) University of Minnesota Twin Cities(明尼苏达大学双城分校) Westlake University(西湖大学) SIAT, CAS(中国科学院软件研究所)

AI总结 本文提出HiCoLoRA框架,通过增强零样本槽位推理实现上下文提示对齐,采用分层LoRA架构、谱联合领域-槽位聚类和语义增强SVD初始化,在多领域数据集上取得最优性能。

Comments Accepted in ACL2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19695 2026-04-15 cs.CL cs.AI cs.IR

DyBBT: Dynamic Balance via Bandit-inspired Targeting for Dialog Policy with Cognitive Dual-Systems

DyBBT:通过老虎机启发式目标实现对话策略的动态平衡

Shuyu Zhang, Yifan Wei, Jialuo Yuan, Xinru Wang, Yanmin Zhu, Bin Li, Yujie Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学) Stanford University(斯坦福大学) University of Sydney(悉尼大学) SIAT, CAS(中国科学院上海硅酸盐研究所) Beijing Institute of Graphic Communication(北京印刷学院)

AI总结 本文提出DyBBT框架,通过结构化认知状态空间解决对话探索挑战,结合快速直觉推理与慢速 deliberative 推理,提升对话策略的成功率、效率和泛化能力。

Comments Accepted in ACL2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏