arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-03-03 至 2026-03-03 共收录 50
2603.02130 2026-03-03 cs.CV

Stereo-Inertial Poser: Towards Metric-Accurate Shape-Aware Motion Capture Using Sparse IMUs and a Single Stereo Camera

立体视觉惯性定位器:利用稀疏IMUs和单个立体摄像头实现精确的形状感知运动捕捉

Tutian Tang, Xingyu Ji, Yutong Li, MingHao Liu, Wenqiang Xu, Cewu Lu

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Meta Robotics Institute, SJTU(SJTU机器人研究院) Shanghai Innovation Institute(上海创新研究院)

AI总结 立体视觉惯性定位器利用单个立体摄像头和六个IMUs,通过校准基线几何解决深度模糊问题,实现精确且形状感知的3D人体运动捕捉。

Comments The code, data, and supplementary materials are available at \url{https://sites.google.com/view/stereo-inertial-poser}. Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02079 2026-03-03 cs.CV

MMNavAgent: Multi-Magnification WSI Navigation Agent for Clinically Consistent Whole-Slide Analysis

MMNavAgent: 多倍率WSI导航代理用于临床一致的全滑片分析

Zhengyang Xu, Han Li, Jingsong Liu, Linrui Xie, Xun Ma, Xin You, Shihui Zu, Ayako Ito, Xinyu Hao, Hongming Xu, Shaohua Kevin Zhou, Nassir Navab, Peter J. Schüffler

机构 * Institute of Pathology, Technical University of Munich, Germany(慕尼黑技术大学病理研究所) Munich Data Science Institute (MDSI), Munich, Germany(慕尼黑数据科学研究所) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心) Computer Aided Medical Procedures (CAMP), TU Munich, Munich, Germany(计算机辅助医疗程序(CAMP),慕尼黑技术大学) Dalian University of Technology(大连理工大学) Cancer Hospital of Dalian University of Technology, Shenyang(大连理工大学肿瘤医院) Department of Human Pathology, Juntendo University Graduate School of Medicine(立命大学医学研究生院人类病理部门) University of Science and Technology of China(中国科学技术大学) Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医学机器人研究所) Northwest University of China(中国西北大学)

AI总结 MMNavAgent通过多倍率交互建模和自适应倍率选择,提升全滑片图像诊断性能,实验显示AUC和BACC均有所提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01913 2026-03-03 cs.CV

Zero-shot Low-Field MRI Enhancement via Diffusion-Based Adaptive Contrast Transport

零场MRI增强通过扩散基于自适应对比传输

Muyu Liu, Chenhe Du, Xuanyu Tian, Qing Wu, Xiao Wang, Haonan Zhang, Hongjiang Wei, Yuyao Zhang

机构 * School of Information Science and Technology, ShanghaiTech University, Shanghai, China(信息科学与技术学院,上海科技大学) School of Biomedical Engineering, Shanghai Jiao Tong University, Shanghai, China(生物医学工程学院,上海交通大学)

AI总结 本文提出DACT框架,通过扩散模型和自适应对比传输技术,在无配对监督的情况下实现低场MRI到高场MRI的高质量图像重建,提升组织对比和结构细节。

Comments 11 pages, 4 figures, conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01890 2026-03-03 cs.CV

Resolving Blind Inverse Problems under Dynamic Range Compression via Structured Forward Operator Modeling

通过结构化前向算子建模解决动态范围压缩下的盲逆问题

Muyu Liu, Xuanyu Tian, Chenhe Du, Qing Wu, Hongjiang Wei, Yuyao Zhang

机构 * Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家) ShanghaiTech University(上海科技大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出CaMB-Diff,通过结构化前向算子建模解决动态范围压缩下的盲逆问题,提升信号保真度和物理一致性。

Comments 16 pages, 10 figures, conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23697 2026-03-03 cs.CV

Towards Source-Aware Object Swapping with Initial Noise Perturbation

面向源感知的对象交换的初始噪声扰动

Jiahui Zhan, Xianbing Sun, Xiangnan Zhu, Yikun Ji, Ruitong Liu, Liqing Zhang, Jianfu Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 SourceSwap通过初始噪声扰动实现自监督对象交换,无需额外数据即可实现高质量跨对象对齐和零样本推理。

Comments This paper is accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01813 2026-03-03 cs.RO

SSMG-Nav: Enhancing Lifelong Object Navigation with Semantic Skeleton Memory Graph

SSMG-Nav: 通过语义骨架记忆图增强终身物体导航

Haochen Niu, Lantao Zhang, Xingwu Ji, Rendong Ying, Peilin Liu, Fei Wen

机构 * Brain-Inspired Application Technology Center (BATC), Shanghai Jiao Tong University(脑启发应用技术中心(BATC),上海交通大学)

AI总结 SSMG-Nav通过语义骨架记忆图提升终身物体导航,整合多模态信息与持久记忆,优化路径效率与任务成功率。

Comments Accepted by 2026 ICRA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01698 2026-03-03 cs.CV cs.AI

Towards Principled Dataset Distillation: A Spectral Distribution Perspective

迈向原则化的数据集蒸馏:从谱分布视角

Ruixi Wu, Shaobo Wang, Jiahuan Chen, Zhiyuan Liu, Yicun Yang, Zhaorun Chen, Zekai Li, Kaixin Li, Xinming Wang, Hongzhu Yi, Kai Wang, Linfeng Zhang

机构 * EPIC Lab, SJTU(上海交通大学EPIC实验室) UChicago(芝加哥大学) NUS(新加坡国立大学) CASIA(中国科学院自动化研究所) UCAS(中国科学院自动化研究所)

AI总结 本文提出CSDM方法,通过谱分布匹配解决长尾数据集中的分布对齐问题,实现性能提升并增强稳定性。

Comments 30 pages, 5 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01673 2026-03-03 cs.RO

B$^2$F-Map: Crowd-sourced Mapping with Bayesian B-spline Fusion

B$^2$F-Map:基于贝叶斯B样条融合的众包制图

Yiping Xie, Yuxuan Xia, Erik Stenborg, Junsheng Fu, Axel Beauvisage, Gabriel E. Garcia, Tianyu Wu, Gustaf Hendeby

机构 * Zenseact Department of Electrical Engineering, Linköping University(Linköping大学电子工程系) Department of Automation and Perception, Shanghai Jiao Tong University(上海交通大学自动化与感知系) Chalmers University of Technology(查尔姆斯技术大学)

AI总结 B$^2$F-Map通过贝叶斯B样条融合技术,利用轻量级地图和消费级传感器,在无需高精度地图的情况下实现高效众包制图。

Comments Accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01590 2026-03-03 cs.IR cs.LG

IDProxy: Cold-Start CTR Prediction for Ads and Recommendation at Xiaohongshu with Multimodal LLMs

IDProxy:小红书广告与推荐中基于多模态大语言模型的冷启动CTR预测

Yubin Zhang, Haiming Xu, Guillaume Salha-Galvan, Ruiyan Han, Feiyang Xiao, Yanhua Huang, Li Lin, Yang Luo, Yao Hu

机构 * Xiaohongshu Inc.(小红书公司) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

AI总结 IDProxy通过多模态大语言模型生成代理嵌入,解决广告和推荐系统中物品冷启动的CTR预测问题,实现与现有嵌入空间的对齐和端到端优化,已在小红书大规模应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01563 2026-03-03 cs.LG cs.AI

LFPO: Likelihood-Free Policy Optimization for Masked Diffusion Models

LFPO:基于掩码扩散模型的似然自由策略优化

Chenxing Wei, Jiazhen Kang, Hong Wang, Jianqing Zhang, Hao Jiang, Xiaolong Xu, Ningyuan Sun, Ying He, F. Richard Yu, Yao Shu, Bo Jiang

机构 * Shenzhen University(深圳大学) Hong Kong University of Science(香港科学大学) Guangdong Laboratory of Artificial Intelligence(广东省人工智能与数字经济实验室) University of Science(科学技术大学) Shanghai Jiao Tong University(上海交通大学) Carleton University(卡尔顿大学) Southeast University(东南大学)

AI总结 LFPO通过似然自由策略优化提升掩码扩散模型的生成质量与推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01553 2026-03-03 cs.AI cs.LG

State-Action Inpainting Diffuser for Continuous Control with Delay

具有延迟的连续控制状态-动作修复扩散器

Dongqi Han, Wei Wang, Enze Zhang, Dongsheng Li

机构 * University of Pennsylvania(宾夕法尼亚大学) Shanghai Jiaotong University(上海交通大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 SAID通过结合动力学学习和策略优化,提出了一种具有延迟的连续控制新方法,实现了最先进的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01477 2026-03-03 cs.RO

SFCo-Nav: Efficient Zero-Shot Visual Language Navigation via Collaboration of Slow LLM and Fast Attributed Graph Alignment

SFCo-Nav: 通过慢LLM与快速属性图对齐的协作实现高效的零样本视觉语言导航

Chaoran Xiong, Litao Wei, Xinhao Hu, Kehui Ma, Ziyi Xia, Zixin Jiang, Zhen Sun, Ling Pei

机构 * Shanghai Key Laboratory of Navigation and Location Based Services, Shanghai Jiao Tong University(上海导航与位置基于服务重点实验室,上海交通大学)

AI总结 SFCo-Nav通过慢LLM与快速属性图对齐的协作,实现了高效的零样本视觉语言导航,显著提升效率并降低计算成本。

Comments Accepted by 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01093 2026-03-03 math.NA cs.LG cs.NA

Adaptive-Growth Randomized Neural Networks for Level-Set Computation of Multivalued Nonlinear First-Order PDEs with Hyperbolic Characteristics

自适应增长随机神经网络用于多值非线性一阶偏微分方程的水平集计算

Haoning Dang, Shi Jin, Fei Wang

机构 * School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, Shaanxi 710049, China(数学与统计学学院,西安交通大学,西安,陕西 710049,中国) School of Mathematical Sciences & Institute of Natural Sciences, Shanghai Jiao Tong University, Shanghai 200240, China(数学科学学院及自然科学研究所,上海交通大学,上海 200240,中国) School of Mathematics and Statistics & State Key Laboratory of Multiphase Flow in Power Engineering, Xi’an Jiaotong University, Xi’an, Shaanxi 710049, China(数学与统计学学院及电力工程多相流国家重点实验室,西安交通大学,西安,陕西 710049,中国)

AI总结 本文提出自适应增长随机神经网络方法,用于高效计算具有双曲特征的非线性一阶偏微分方程的多值解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01082 2026-03-03 cs.CV cs.IR

Beyond Global Similarity: Towards Fine-Grained, Multi-Condition Multimodal Retrieval

超越全局相似性:面向细粒度、多条件多模态检索

Xuan Lu, Kangle Li, Haohang Huang, Rui Meng, Wenjun Zeng, Xiaoyu Shen

机构 * Shanghai Jiao Tong University(上海交通大学) Institute of Digital Twin, Eastern Institute of Technology(数字孪生研究院,东部技术研究所) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative(宁波空间智能与数字衍生关键实验室)

AI总结 MCMR提出一个多条件多模态检索基准,通过细粒度多模态检索评估模型在复杂查询中的条件感知推理能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22286 2026-03-03 cs.LG cs.IT math.IT

OmniZip: Learning a Unified and Lightweight Lossless Compressor for Multi-Modal Data

OmniZip: 一种用于多模态数据的统一且轻量级无损压缩器

Yan Zhao, Zhengxue Cheng, Junxuan Zhang, Dajiang Zhou, Qunshan Gu, Qi Wang, Li Song

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

AI总结 OmniZip是一种用于多模态数据的统一且轻量级无损压缩器,通过三种关键组件实现高效压缩,并在多个数据集上实现了更高的压缩效率。

Comments 8 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26389 2026-03-03 cs.LG cs.MA

Adaptive Context Length Optimization with Low-Frequency Truncation for Multi-Agent Reinforcement Learning

具有低频截断的自适应上下文长度优化用于多智能体强化学习

Wenchang Duan, Yaoliang Yu, Jiwan He, Yi Shi

机构 * Shanghai Jiao Tong University(上海交通大学) University of Waterloo(滑铁卢大学)

AI总结 本文提出了一种具有低频截断的自适应上下文长度优化方法,通过动态优化上下文长度和过滤冗余信息,提升多智能体强化学习在长期依赖任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19842 2026-03-03 cs.AI cs.LG

DAG-Math: Graph-of-Thought Guided Mathematical Reasoning in LLMs

DAG-Math: 图思维引导的大型语言模型数学推理

Yuanhe Zhang, Ilja Kuzborskij, Jason D. Lee, Chenlei Leng, Fanghui Liu

机构 * Department of Statistics, University of Warwick(沃里克大学统计系) Google DeepMind(谷歌DeepMind) Department of Applied Mathematics, Hong Kong Polytechnic University(香港理工大学应用数学系) School of Mathematical Sciences, Institute of Natural Sciences and MOE-LSC, Shanghai Jiao Tong University(上海交通大学数学科学学院)

AI总结 DAG-Math通过构建图思维引导的数学推理框架,评估LLM的推理能力,揭示了推理忠实度与最终答案准确性的差异。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09285 2026-03-03 cs.CV

Spotlight on Token Perception for Multimodal Reinforcement Learning

多模态强化学习中的token感知聚焦

Siyuan Huang, Xiaoye Qu, Yafu Li, Yun Luo, Zefeng He, Daizong Liu, Yu Cheng

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Nanjing University(南京大学) Wuhan University(武汉大学)

AI总结 本文提出VPPO算法,通过token感知优化提升多模态强化学习的视觉推理能力。

Comments Accepted by ICLR 2026, project page: https://github.com/huaixuheqing/VPPO-RL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23040 2026-03-03 cs.CL cs.AI

Look Back to Reason Forward: Revisitable Memory for Long-Context LLM Agents

回望以推导前行:用于长上下文LLM代理的可回溯记忆

Yaorui Shi, Yuxin Chen, Siyuan Wang, Sihang Li, Hengxing Cai, Qi Gu, Xiang Wang, An Zhang

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) DP Technology(DP科技) Meituan(美团)

AI总结 ReMemR1通过整合记忆检索机制和多级奖励设计,提升长上下文问答任务的推理能力与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13305 2026-03-03 cs.CV

Prune2Drive: A Plug-and-Play Framework for Accelerating Vision-Language Models in Autonomous Driving

Prune2Drive: 一种用于自动驾驶中加速视觉-语言模型的即插即用框架

Minhao Xiong, Zichen Wen, Zhuangcheng Gu, Xuyang Liu, Rui Zhang, Hengrui Kang, Jiabing Yang, Junyuan Zhang, Weijia Li, Conghui He, Yafei Wang, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Carnegie Mellon University(卡内基梅隆大学) Sichuan University(四川大学) University of Chinese Academy of Sciences(中国科学院大学) The University of Hong Kong(香港大学)

AI总结 Prune2Drive通过视觉令牌修剪框架在自动驾驶中加速视觉-语言模型,实现显著速度提升和内存节省,性能影响小。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06027 2026-03-03 cs.CV eess.IV

OSDM-MReg: Multimodal Image Registration based One Step Diffusion Model

OSDM-MReg: 基于一步扩散模型的多模态图像配准

Xiaochen Wei, Weiwei Guo, Wenxian Yu, Feiming Wei, Dongying Li

机构 * Shanghai Key Laboratory of Intelligent Sensing and Recognition(上海智能感知与识别重点实验室) Shanghai Jiao Tong University(上海交通大学) Center of Digital Innovation(数字创新中心)

AI总结 OSDM-MReg通过一步扩散模型和多模态融合策略,实现多模态图像配准的高效准确配准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23348 2026-03-03 cs.RO cs.CV

Physically Ground Commonsense Knowledge for Articulated Object Manipulation with Analytic Concepts

为拟合物体操纵的物理常识知识而引入分析概念

Jiude Wei, Yuxuan Li, Cewu Lu, Jianhua Sun

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出通过引入分析概念,将语义级常识知识接地到物理世界,以提升机器人对关节物体的通用精确操纵能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12988 2026-03-03 cs.AR cs.AI

ROMA: a Read-Only-Memory-based Accelerator for QLoRA-based On-Device LLM

ROMA: 一种基于只读存储器的QLoRA加速器

Wenqiang Wang, Yijia Zhang, Zikai Zhang, Guanting Huo, Hao Liang, Shijie Cao, Ningyi Xu

机构 * Shanghai Jiao Tong University(上海交通大学) Huixi Intelligence(汇溪智能) Peking University(北京大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 ROMA是一种基于只读存储器的QLoRA加速器,通过混合存储架构和B-ROM设计,实现高效存储和加速LLM在边缘设备上的部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18041 2026-03-03 cs.CV cs.RO

Openfly: A comprehensive platform for aerial vision-language navigation

Openfly:面向空中视觉-语言导航的综合性平台

Yunpeng Gao, Chenhui Li, Zhongrui You, Junli Liu, Zhen Li, Pengan Chen, Qizhi Chen, Zhonghan Tang, Liansheng Wang, Penghui Yang, Yiwen Tang, Yuhang Tang, Shuai Liang, Songyi Zhu, Ziqin Xiong, Yifei Su, Xinyi Ye, Jianan Li, Yan Ding, Dong Wang, Xuelong Li, Zhigang Wang, Bin Zhao

机构 * Shanghai AI Laboratory(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Beihang University(北航) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) East China University of Science and Technology(东华大学) Fudan University(复旦大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) TeleAI

AI总结 OpenFly平台通过整合多种渲染引擎和自动化工具链,构建大规模空中VLN数据集,并提出关键帧感知的VLN模型,提升户外空中视觉-语言导航的研究与应用。

Comments accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17237 2026-03-03 cs.CV

Grounding-IQA: Grounding Multimodal Language Model for Image Quality Assessment

Grounding-IQA: 多模态语言模型的接地图像质量评估

Zheng Chen, Xun Zhang, Wenbo Li, Renjing Pei, Fenglong Song, Xiongkuo Min, Xiaohong Liu, Xin Yuan, Yong Guo, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Joy Future Academy(京东探索研究院) Huawei Noah’s Ark Lab(华为诺亚实验室) Westlake University(西湖大学) Huawei(华为)

AI总结 本文提出grounding-IQA任务范式,通过结合多模态指称与图像质量评估,实现更细粒度的图像质量感知。

Comments Accepted to ICLR 2026. Code is available at: https://github.com/zhengchen1999/Grounding-IQA

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00990 2026-03-03 cs.CV

MLRecon: Robust Markerless Freehand 3D Ultrasound Reconstruction via Coarse-to-Fine Pose Estimation

MLRecon: 通过粗到细的姿态估计实现鲁棒的无标记自由手3D超声重建

Yi Zhang, Puxun Tu, Kun Wang, Yulin Yan, Tao Ying, Xiaojun Chen

机构 * Institute of Biomedical Manufacturing and Life Quality Engineering, School of Mechanical Engineering, Shanghai Jiao Tong University, Shanghai, China(生物医学制造与生命质量工程学院,机械工程学院,上海交通大学,上海,中国) Department of Ultrasound in Medicine, Shanghai Sixth People's Hospital Affiliated to Shanghai Jiao Tong University School of Medicine, Shanghai, China(医学超声科,上海第六人民医院(隶属于上海交通大学医学院)) Institute of Medical Robotics, Shanghai Jiao Tong University, Shanghai, China(医学机器人研究院,上海交通大学,上海,中国)

AI总结 MLRecon通过粗到细姿态估计实现无标记自由手3D超声重建,有效解决漂移问题,实现高精度的6D探头跟踪与高质量3D成像。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00948 2026-03-03 cs.RO

HierKick: Hierarchical Reinforcement Learning for Vision-Guided Soccer Robot Control

HierKick:基于分层强化学习的视觉引导足球机器人控制

Yizhi Chen, Zheng Zhang, Zhanxiang Cao, Yihe Chen, Shengcheng Fu, Liyun Yan, Yang Zhang, Jiali Liu, Haoyang Li, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Jiangxi University of Finance(江西财经大学) East China Normal University(华东师范大学)

AI总结 HierKick通过双频分层强化学习框架,结合视觉检测与任务选择,实现足球机器人多时间尺度决策控制,提升复杂环境下的任务成功率。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00623 2026-03-03 cs.AI cs.CL

TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces

TraceSIR: 一个用于结构化分析和报告代理执行轨迹的多代理框架

Shu-Xun Yang, Cunxiang Wang, Haoke Zhang, Wenbo Yu, Lindong Wu, Jiayi Gui, Dayong Yang, Yukuo Cen, Zhuoer Feng, Bosi Wen, Yidong Wang, Lucen Zhong, Jiamin Ren, Linfeng Zhang, Jie Tang

机构 * Beijing Institute of Technology(北京理工大学) Zhipu AI(智谱AI) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 TraceSIR通过多代理框架结构化分析和报告代理执行轨迹,提升故障诊断和根本原因分析效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00609 2026-03-03 cs.CV

Linking Modality Isolation in Heterogeneous Collaborative Perception

异构协作感知中的模态隔离问题

Changxing Liu, Zichen Chao, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Nanjing University of Science and Technology(南京理工大学)

AI总结 CodeAlign通过跨模态特征-代码-特征翻译有效解决异构协作感知中的模态隔离问题,显著降低训练参数和通信负载,提升感知性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00597 2026-03-03 cs.RO

AI-IO: An Aerodynamics-Inspired Real-Time Inertial Odometry for Quadrotors

AI-IO:一种受空气动力学启发的实时惯性里程计用于四旋翼

Jiahao Cui, Feng Yu, Linzuo Zhang, Yu Hu, Danping Zou

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出了一种基于变压器的AI-IO方法,通过引入旋翼速度测量提升四旋翼惯性里程计的精度和实时性能。

Comments 8 pages, 8 figures, 2026 IEEE International Conference on Robotics(ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏