arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1017 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1017 篇

2507.09251 2026-07-21 q-bio.BM 版本更新 50%

Reshaping Biomolecular Structure Prediction through Strategic Conformational Exploration with HelixFold-S1

通过HelixFold-S1的策略性构象探索重塑生物分子结构预测

Lihang Liu, Yang Liu, Xianbin Ye, Shanzhuo Zhang, Yuxin Li, Kunrui Zhu, Yang Xue, Xiaonan Zhang, Xiaomin Fang

专题命中 规划决策 :planning(abstract)

AI总结 HelixFold-S1通过策略性探索构象空间,提高生物分子结构预测的准确性并减少采样需求,利用预测的链间接触概率指导计算资源分配,实现高效且精确的结构推断。

Journal ref Nature Machine Intelligence (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23185 2026-07-21 cs.RO 版本更新 50%

Physically-Feasible Reactive Synthesis for Terrain-Adaptive Locomotion

用于地形自适应运动的物理可行反应式合成

Ziyi Zhou, Qian Meng, Hadas Kress-Gazit, Ye Zhao

机构 * Georgia Institute of Technology(佐治亚理工学院) Cornell University(康奈尔大学)

专题命中 规划决策 :planning(abstract)

AI总结 针对四足动物在动态变化地形的运动规划问题,提出综合规划框架,结合反应式合成与混合整数凸规划,采用符号修复机制,经实验验证该框架能识别缺失技能并在关键环境有效响应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05298 2026-07-21 cs.RO 版本更新 50%

GhostShell: Streaming LLM Function Calls for Concurrent Embodied Programming

GhostShell:用于并发实体编程的流式大语言模型函数调用

Jian Gong, Youwei Huang, Bo Yuan, Ming Zhu, Zhou Liao, Jianhang Liang, Juncheng Zhan, Jinke Wang, Hang Shu, Zihao Xu, Mingyue Xiong, Yanjun Ye, Yufan Zu, Yang Zhou, Yihan Ding, Xuannian Chen, Xingyu Lu, Runjie Ban, Bingchao Huang

专题命中 规划决策 :function calling(abstract)

AI总结 研究提出GhostShell方法,利用大语言模型进行实体系统的流式和并发行为编程。通过定义函数令牌及多通道调度算法协调调用,在机器人原型上评估,该方法在任务完成率等方面表现出色,尤其在协调并发动作上优势明显。

Comments 22 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13960 2026-07-20 cs.RO 版本更新 50%

GigaWorld-Policy-0.5: A Faster and Stronger WAM Empowered by AutoResearch

GigaWorld-Policy-0.5:由自动研究赋能的更快更强的世界行动模型

GigaWorld Team, Angen Ye, Angyuan Ma, Boyuan Wang, Chaojun Ni, Fangzheng Ye, Guan Huang, Guo Li, Guosheng Zhao, Haodong Yan, Hengtao Li, Jiwen Lu, Kai Wang, Mingming Yu, Qitang Hu, Qiuping Deng, Songling Liu, Xiaoyu Tian, Xiaofeng Wang, Xinyu Zhou, Xiuwei Xu, Xinze Chen, Yang Wang, Yejun Zeng, Yifan Chang, Yun Ye, Zhenyu Wu, Zhanqian Wu, Zheng Zhu

机构 * GigaAI(字节跳动人工智能实验室) Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract)

AI总结 研究旨在改进机器人策略学习,提出GigaWorld-Policy-0.5这一增强型以动作中心的WAM。预训练采用混合策略加强视觉与动作耦合,推理引入新架构提升效率,还用自动研究管道搜索训练配置,有效提升了机器人控制推理效率并保留训练优势。

Comments project page: https://open-gigaai.github.io/giga-world-policy/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09581 2026-07-20 cs.CV cs.SD 版本更新 50%

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation

万舞者:一种用于分钟级连贯音乐到舞蹈生成的分层框架

Mingyang Huang, Peng Zhang, Li Hu, Guangyuan Wang, Ruoshi Zhang, Yi Lu, Gang Cheng, Bang Zhang

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 规划决策 :planning(abstract)

AI总结 针对从音乐生成舞蹈视频的挑战,提出万舞者分层框架,解耦过程为全局关键帧规划和局部时间细化,利用音乐上下文确保连贯,通过动态帧率自适应等创新,突破时长限制,在多舞蹈类型上表现出色,达新的技术水平。

Comments project: https://humanaigc.github.io/wan-dancer-project/, code: https://github.com/Wan-Video/Wan-Dancer, modelscope: https://www.modelscope.cn/models/Wan-AI/Wan-Dancer-14B, huggingface: https://huggingface.co/Wan-AI/Wan2.2-Animate-14B

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01399 2026-07-17 eess.SY cs.RO cs.SY 版本更新 50%

Captivity-Escape Games as a Means for Safety in Online Motion Generation

捕获-逃脱游戏作为在线运动生成中安全性的手段

Christopher Bohn, Manuel Hess, Sören Hohmann

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种方法,通过捕获-逃脱游戏缓解现有框架的保守性、计算成本和数值精度问题,提升在线模型驱动运动生成的安全性。

Comments Accepted for publication in IEEE Transactions on Automatic Control

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10198 2026-07-17 cs.RO 版本更新 50%

Octopus-inspired Distributed Control for Soft Robotic Arms: A Graph Neural Network-Based Attention Policy with Environmental Interaction

章鱼启发的分布式控制用于软机器人手臂:基于图神经网络的注意力策略与环境交互

Linxin Hou, Qirui Wu, Zhihang Qin, Yongxin Guo, Cecilia Laschi

专题命中 规划决策 :agent(abstract)

AI总结 本文提出基于图神经网络的注意力策略,用于软机器人手臂在复杂环境中实现目标接触,通过集中训练分散执行范式提升鲁棒性和性能。

Comments 8 pages, 5 figures, 2 tables, accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15717 2026-07-17 eess.SP 版本更新 50%

Automated detection of circadian-dependent epileptic biomarkers for seizure localization using machine learning and signal processing

使用机器学习和信号处理自动检测昼夜节律依赖性癫痫生物标志物以进行癫痫发作定位

Mehdi Zekriyapanah Gashti, Mostafa Mohammadpour, Hassan Eshkiki, Vahid Ghanbarizadeh

专题命中 规划决策 :planning(abstract)

AI总结 研究旨在利用机器学习和信号处理技术,通过分析耐药性局灶性癫痫患者长期颅内脑电图记录,探索癫痫生物标志物昼夜节律和睡眠依赖性动态,发现睡眠状态分析能提高发作起始区定位准确性,为术前脑电图分析提供指导。

Comments This version corresponds to the published journal article

Journal ref Review of Computer Engineering Research, 13(2), 37- 48, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19244 2026-07-17 cs.CV 版本更新 50%

Lavida-O: Elastic Large Masked Diffusion Models for Unified Multimodal Understanding and Generation

Lavida-O:用于统一多模态理解与生成的弹性大掩码扩散模型

Shufan Li, Jiuxiang Gu, Kangning Liu, Zhe Lin, Zijun Wei, Aditya Grover, Jason Kuen

机构 * Adobe(Adobe公司) UCLA(加州大学洛杉矶分校)

专题命中 规划决策 :planning(abstract)

AI总结 研究提出Lavida-O统一多模态MDM,采用Elastic-MoT架构,结合轻量级生成与理解分支,通过多种技术支持高效生成。该模型在多模态任务基准测试中性能领先,优于现有模型,还能加速推理,成为可扩展多模态推理和生成新范式。

Comments 31 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21268 2026-07-16 cs.CV 版本更新 50%

Vision Transformers and Convolutional Neural Networks for Land Use Scene Classification

视觉Transformer与卷积神经网络在土地利用场景分类中的应用

Arun D. Kulkarni

机构 * Computer Science Department, University of Texas at Tyler(德克萨斯理工大学计算机科学系)

专题命中 规划决策 :planning(abstract)

AI总结 本文比较了视觉Transformer和CNN在遥感土地利用场景分类中的性能,发现CNN在有限训练样本和局部纹理特征强的场景中表现稳健,而ViT在数据充足时能更好地捕捉全局空间关系,但计算成本更高。

Comments 11 pages

Journal ref International Journal of Advanced Computer Science and Applications, vol. 17, no. 7, 2026,

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02741 2026-07-16 cs.RO 版本更新 50%

PokeNet: Learning Kinematic Models of Articulated Objects from Human Observations

PokeNet: 从人类观察中学习机械结构模型

Anmol Gupta, Weiwei Gu, Omkar Patil, Jun Ki Lee, Nakul Gopalan

机构 * School of Computation and AI, ASU, Tempe(计算与人工智能学院,亚利桑那州立大学) AI Institute, Seoul National University, Seoul, South Korea(首尔国立大学人工智能研究所)

专题命中 规划决策 :planning(abstract)

AI总结 PokeNet通过单个人类示范学习机械结构模型,无需先验知识,提升关节轴和状态估计精度达27%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21477 2026-07-15 cs.CR 版本更新 50%

MCP Pitfall Lab: Exposing Developer Pitfalls in MCP Tool Server Security under Multi-Vector Attacks

MCP陷阱实验室:在多向攻击下暴露MCP工具服务器安全漏洞的开发人员陷阱

Run Hao, Zhuoran Tan

专题命中 规划决策 :agent(abstract)

AI总结 本文提出MCP Pitfall Lab框架,通过可复现的场景验证开发人员陷阱,评估MCP工具服务器在多向攻击下的安全性和修复效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13853 2026-07-15 cs.RO 版本更新 50%

Mosaic: An Extensible Framework for Composing Rule-Based and Learned Motion Planners

Mosaic:一种可扩展的用于规则基和学习型运动规划组合的框架

Nick Le Large, Marlon Steiner, Lingguang Wang, Willi Poh, Jan-Hendrik Pauls, Ömer Şahin Taş, Christoph Stiller

机构 * Institute of Measurement and Control Systems, Karlsruhe Institute of Technology (KIT)(测量与控制系统的研究所,卡尔斯鲁厄理工学院) FZI Research Center for Information Technology(信息技术研究所以)

专题命中 规划决策 :planning(abstract)

AI总结 Mosaic框架结合规则基和学习型运动规划方法,通过仲裁图实现结构化决策,提高自动驾驶的安全性和可解释性,实验表明其在多个基准测试中表现优异。

Comments accepted for presentation at 2026 IEEE/RSJ International Conference on Intelligent Robots & Systems, 8 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10609 2026-07-15 cs.IR 版本更新 50%

iTIMO: An LLM-empowered Synthesis Dataset for Travel Itinerary Modification

iTIMO:一个基于大语言模型的旅行行程修改合成数据集

Zhuoxuan Huang, Yunshan Ma, Hongyu Zhang, Hua Ma, Zhu Sun

专题命中 规划决策 :planning(abstract)

AI总结 iTIMO通过基于大语言模型的意图驱动扰动任务,构建了一个用于旅行行程修改的合成数据集,用于评估和改进旅行推荐系统。

Comments Accepted by SIGIR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17969 2026-07-15 eess.SY cs.SY 版本更新 50%

Mixed Bernstein-Fourier Approximants for Optimal Trajectory Generation with Periodic Behavior

用于具有周期性行为的最优轨迹生成的混合伯恩斯坦 - 傅里叶逼近

Liraz Mudrik, Sean Kragelund, Isaac Kaminer

专题命中 规划决策 :planning(abstract)

AI总结 针对自主系统中最优轨迹生成问题,提出混合伯恩斯坦 - 傅里叶逼近框架,利用伯恩斯坦多项式和傅里叶级数特性,通过调节最小二乘法确定系数,提升计算效率和精度,为最优轨迹规划提供了有效方法。

Comments 56 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10719 2026-07-14 cs.CV 版本更新 50%

SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving

SpaceDrive: 在基于视觉语言模型的自动驾驶中引入空间感知

Peizheng Li, Zhenghao Zhang, David Holtz, Hang Yu, Yutong Yang, Yuzhi Lai, Rui Song, Andreas Geiger, Andreas Zell

机构 * Mercedes-Benz AG(梅赛德斯-奔驰集团) University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) TU Munich(慕尼黑工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) University of Stuttgart(斯图加特大学) UCLA(加州大学洛杉矶分校)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出SpaceDrive框架,通过将空间信息作为显式位置编码来增强基于VLM的自动驾驶系统对精细3D空间关系的理解,从而提升规划精度和开放环性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14551 2026-07-14 cs.RO 版本更新 50%

Replanning Human-Robot Collaborative Tasks with Vision-Language Models via Semantic and Physical Dual-Correction

通过语义和物理双校正利用视觉语言模型重新规划人机协作任务

Taichi Kato, Takuya Kiyokawa, Namiko Saito, Kensuke Harada

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种通过语义和物理双校正机制提升人机协作任务中机器人重新规划能力的框架,结合视觉语言模型与物理反馈纠正,提高任务执行的成功率和可行性。

Comments 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14480 2026-07-14 cs.NI 版本更新 50%

A benchmarking framework for PON-based fronthaul network design

基于无源光网络的前传网络设计基准框架

Egemen Erbayat, Gustavo B. Figueiredo, Shih-Chun Lin, Motoharu Matsuura, Hiroshi Hasegawa, Suresh Subramaniam

专题命中 规划决策 :planning(abstract)

AI总结 针对移动网络向5G和6G过渡时无源光网络前传传输缺乏标准化评估模型的问题,提出统一基准框架,用整数线性规划制定网络设计问题,评估三种启发式策略,结果显示限时ILP性能优,RSSA+接近ILP且确保可行性。

Journal ref J. Opt. Commun. Netw. 18, D68-D79 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31271 2026-07-13 cs.CV 版本更新 50%

DriveMA: Driving Vision-Language-Action Models with verifiable Meta-Actions

DriveMA:基于可验证元动作的驾驶视觉-语言-动作模型

Weicheng Zheng, Yixin Huang, Qiao Sun, Derun Li, Hang Zhao

机构 * Shanghai Qi Zhi Institute(上海启智研究院) Tsinghua University(清华大学) Tongji University(同济大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出DriveMA框架,通过可验证元动作弥合语言与动作的差距,结合动作中心监督训练和强化学习实现端到端驾驶规划,在Waymo Open Dataset上取得最优性能。

Comments arXiv admin note: text overlap with arXiv:2605.21273

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21855 2026-07-10 cs.DC cs.DB cs.NI 版本更新 50%

Self-Adaptive Probabilistic Skyline Analytics in Cloud-Edge IoE: A Multi-Objective DRL Approach

云边万物互联中的自适应概率天际线分析:一种多目标深度强化学习方法

Chuan-Chi Lai

专题命中 规划决策 :agent(abstract)

AI总结 针对云边万物互联中概率天际线查询分析难题,提出SA-PSKY框架,集成深度强化学习与分布式查询优化,通过马尔可夫决策过程和自适应加权机制,结合优先经验回放,有效降低延迟,提升可扩展性,优于基线方法。

Comments 15 pages, 2 tables, 5 figures. Manuscript currently under review at IEEE Transactions on Cloud Computing (TCC). This version includes extended scalability analysis and refined theoretical proofs

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03075 2026-07-10 cs.RO 版本更新 50%

A Collaborative Reasoning Framework for Anomaly Diagnostics in Underwater Robotics

水下机器人异常诊断的协作推理框架

Markus Buchholz, Niamh Ellis, Rahaf Abu Hara, Ignacio Carlucho, Yvan R. Petillot

机构 * School of Engineering & Physical Sciences, Heriot-Watt University(工程与物理科学学院,赫瑞斯泰大学)

专题命中 规划决策 :agent(abstract)

AI总结 研究水下机器人异常诊断,提出AURA协作框架,集成大语言模型、数字孪生和人在回路交互,通过两个代理进行异常检测与诊断,经人类验证的诊断转化为训练示例完善模型,建立可信赖、不断改进的人机团队模式。

Comments Paper was submitted for ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29744 2026-07-09 cs.CV 版本更新 50%

HTC-SGA Former: A Hybrid Transformer-CNN Network with Self-Guided Attention and a New Boundary-Weighted Adaptive Loss for Coronary DSA Vessel Segmentation

HTC-SGA Former: 一种结合自引导注意力与新型边界加权自适应损失的混合Transformer-CNN网络用于冠状动脉DSA血管分割

Rayan Merghani Ahmed, Marwa Omer Mohammed Omer, Mohamed Elmanna, Shijie Li, Bin Li, Shoujun Zhou

机构 * Shenzhen Institutes of Advanced Technology (SIAT)(深圳先进技术研究院) University of Chinese Academy of Sciences (UCAS)(中国科学院大学) Department of Biomedical Engineering and Systems, Faculty of Engineering(工程学院生物医学工程与系统系) Cairo University(开罗大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出HTC-SGA Former混合网络,通过CNN编码器提取局部血管形态、Transformer解码器建模上下文、MS-GLWA模块实现全局-局部注意力、SGFA模块增强弱血管响应及BWACL损失函数优化边界,在0.81M参数下超越14种方法,提升细血管恢复与连续性。

Comments 20 pages, 10 figures, 3 tables. Submitted for journal review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24892 2026-07-09 cs.CV 版本更新 50%

X-Foresight: A Joint Vision-Action Causal Forecasting Network via Predictive World Modeling

X-Foresight:一种通过预测世界建模的联合视觉-动作因果预测网络

Baolu Li, Jingyu Qian, Rui Guo, Yilun Chen, Hanpeng Liu, Yuan Lin, Junhong Zhou, Ruixin Liu, Liu Yang, Yutong Zheng, Zhenli Zhang, Sean Li, Chaoda Zheng, Boyang Wang, Tenglong, Gu, Zhuangzhuang Ding, Pengkun Zheng, Yu Zhang, Xianming Liu

机构 * PWM Team(PWM团队) XPeng Inc.(XPeng公司)

专题命中 规划决策 :planning(abstract)

AI总结 提出X-Foresight,一种将预测世界模型直接集成到VLA架构中的方法,通过长程分块自回归策略和课程学习,联合学习世界建模与实时动作控制,以解决视频预测中的低熵冗余和长程因果建模难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06445 2026-07-09 cs.CV 版本更新 50%

What if? Emulative Simulation with World Models for Situated Reasoning

如果呢?基于世界模型的仿真模拟用于情境推理

Ruiping Liu, Yufan Chen, Yuheng Zhang, Junwei Zheng, Kunyu Peng, Chengzhi Wu, Chenguang Huang, Di Wen, Jiaming Zhang, Kailun Yang, Rainer Stiefelhagen

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Hunan University(湖南大学) ETH Zürich(苏黎世联邦理工学院) INSAIT, Sofia University ``St. Kliment Ohridski''(INSAIT,索菲亚大学『圣克莱门特·奥赫里迪斯』) RAI Institute(RAI研究所)

专题命中 规划决策 :agent(abstract)

AI总结 提出WanderDream数据集,利用世界模型进行心理探索的仿真模拟,使代理无需主动探索即可回答空间假设问题,实验证明心理探索对情境推理至关重要。

Comments Accepted at ECCV 2026. The data and code are available at: https://github.com/RuipingL/WanderDream

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24108 2026-07-09 cs.RO cs.CV 版本更新 50%

Zero-Human Demonstration End-to-end Autonomous Driving with Trajectory Scorer

基于轨迹评分器的零人类示范端到端自动驾驶

Zhenxin Li, Nadine Chang, Wenhao Yao, Xinglong Sun, Zi Wang, Maying Shen, Jingde Chen, Jingyu Song, Kailin Li, Zuxuan Wu, Shiyi Lan, Jose M. Alvarez

机构 * Institute of Trustworthy Embodied AI(可信具身人工智能研究所) Fudan University(复旦大学) Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室) NVIDIA University of Michigan(密歇根大学) East China Normal University(华东师范大学)

专题命中 规划决策 :planning(abstract)

AI总结 研究提出ZTRS,一种基于强化学习的端到端自动驾驶规划范式,仅依靠真实世界图像和规则奖励训练,无需人类示范。通过详尽策略优化,能更好推广到长尾驾驶场景,在相关数据集上展现出优于模仿学习方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08366 2026-07-09 econ.GN q-fin.EC 版本更新 50%

A data fusion approach for mobility hub impact assessment and location selection: integrating hub usage data into a large-scale mode choice model

一种用于移动枢纽影响评估和选址的数据融合方法:将枢纽使用数据整合到大规模出行选择模型中

Xiyuan Ren, Joseph Y. J. Chow

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种数据融合方法,将移动枢纽使用数据整合到大规模出行选择模型中,评估枢纽对出行需求、出行方式转换、减少车辆行驶里程和增加消费者剩余的影响。

Journal ref Transportation Research Part A, 211 (2026), 105138

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25126 2026-07-08 cs.RO 版本更新 50%

HANDFUL: Sequential Grasp-Conditioned Dexterous Manipulation with Resource Awareness

HANDFUL: 有意识资源利用的顺序抓取-条件灵活操作

Ethan Foong, Yunshuang Li, Hao Jiang, Gaurav S. Sukhatme, Daniel Seita

机构 * Northwestern University(西北大学) University of Southern California(南加州大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出HANDFUL框架,通过资源感知抓取提升多任务操作的灵活性和鲁棒性,结合仿真与现实验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25155 2026-07-08 physics.soc-ph 版本更新 50%

Bidirectional yet asymmetric causality between urban systems and traffic dynamics in 30 cities worldwide

全球30个城市中城市系统与交通动态之间的双向但不对称因果关系

Yatao Zhang, Ye Hong, Song Gao, Martin Raubal

专题命中 规划决策 :planning(abstract)

AI总结 研究全球30个城市中城市系统与交通动态的关系,提出时空因果框架,结合时空加权回归与收敛交叉映射,揭示双向不对称因果关系及三种因果原型,为可持续城市和交通规划提供策略依据。

Comments Published in Nature Communications

Journal ref Nature Communications 17, 4671 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02401 2026-07-07 cs.IT math.IT physics.app-ph 版本更新 50%

Cross-Domain Radiomap Prediction for Multi-Scatterer Environment: A Spherical-Wave-Based Approach

多散射体环境下的跨域无线电地图预测:基于球面波的方法

Wenli Li, Bin Wang, Haiyan Fan, Yujie Zhang, Guangxu Zhu, Yi Zhang

专题命中 规划决策 :planning(abstract)

AI总结 针对高频段多散射体环境下无线电地图预测难题,开发线性前向信道模型,利用球面波模式展开捕捉传播行为,通过稀疏测量联合学习散射响应与散射体位置,实现准确重建与外推。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27243 2026-07-07 cs.CV 版本更新 50%

Can Retrieval Heads See Images? Multimodal Retrieval Heads in Long-Context Vision-Language Models

检索头能看见图像吗?长上下文视觉语言模型中的多模态检索头

Aaron Branson Cigres Li, Zhaowei Wang, Yu Zhao, Yiming Du, Haobo Li, Xiyu Ren, Ginny Wong, Simon See, Lishu Luo, Haodong Duan, Pasquale Minervini, Yangqiu Song

机构 * HKUST(香港科技大学) University of Edinburgh(爱丁堡大学) CUHK(香港中文大学) NVAITC, NVIDIA, Santa Clara, USA(NVIDIA Santa Clara 分公司) Tsinghua University(清华大学)

专题命中 规划决策 :agent(abstract)

AI总结 本文提出一种多模态检索头检测方法,发现视觉语言模型中仅有4.4-10.2%的注意力头贡献了50%的正检索分数,这些头对长上下文推理至关重要,且可直接用于文档检索提升性能。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏