arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-02-13 至 2026-02-13 共收录 56 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2512.19269 2026-02-13 cs.RO cs.LG 73%

Translating Flow to Policy via Hindsight Online Imitation

通过回顾在线模仿将流翻译为政策

Yitian Zheng, Zhangchen Ye, Weijun Dong, Shengjie Wang, Yuyang Liu, Chongjie Zhang, Chuan Wen, Yang Gao

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) University of California San Diego(加州大学圣地亚哥分校) Washington University in St. Louis(圣路易斯华盛顿大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Qi Zhi Institute(上海启智研究所)

专题命中 机器人学习 :robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.LG

AI总结 通过回顾在线模仿将流翻译为政策,利用2D点流作为高层规划器,在模拟和现实任务中实现超过2倍的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11393 2026-02-13 cs.RO 57%

Human Preference Modeling Using Visual Motion Prediction Improves Robot Skill Learning from Egocentric Human Video

通过视觉运动预测建模的人类偏好改进从第一人称人类视频中学习机器人技能

Mrinal Verghese, Christopher G. Atkeson

专题命中 机器人学习 :robot learning(abstract);分类 cs.RO

AI总结 通过视觉运动预测建模人类偏好,改进机器人从第一人称视频学习技能

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 18 篇

2602.12032 2026-02-13 cs.RO 88%

When would Vision-Proprioception Policies Fail in Robotic Manipulation?

视觉-本体感觉策略在机器人操作中何时会失败?

Jingxian Lu, Wenke Xia, Yuxuan Wu, Zhiwu Lu, Di Hu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学光明学院人工智能学院) Beijing Key Laboratory of Research on Large Models(北京大模型与智能治理研究重点实验室) School of Artificial Intelligence, Beihang University(北航人工智能学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 研究提出GAP算法,通过动态调节本体感觉优化,解决视觉-本体感觉策略在运动转换阶段的泛化问题。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10983 2026-02-13 cs.RO 88%

Scaling World Model for Hierarchical Manipulation Policies

为分层操作策略扩展世界模型

Qian Long, Yueze Wang, Jiaxi Song, Junbo Zhang, Peiyan Li, Wenxuan Wang, Yuqi Wang, Haoyang Li, Shaoxuan Xie, Guocai Yao, Hanbo Zhang, Xinlong Wang, Zhongyuan Wang, Xuguang Lan, Huaping Liu, Xinghang Li

机构 * Xi’an Jiao Tong University(西安交通大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);分类 cs.RO

AI总结 本文提出分层VLA框架,利用大规模预训练世界模型提升机器人操作在分布外场景的泛化能力,实验显示性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09013 2026-02-13 cs.RO cs.CV 84%

Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction

通过3D手-物体轨迹重建从RGB人类视频中学习灵巧操作策略

Hongyi Chen, Tony Dong, Tiancheng Wu, Liquan Wang, Yash Jangir, Yaru Niu, Yufei Ye, Homanga Bharadhwaj, Zackory Erickson, Jeffrey Ichnowski

机构 * Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 VIDEOMANIP通过3D手-物体轨迹重建从RGB视频直接学习灵巧操作策略,实现无需设备的高效训练和高成功率抓取

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06643 2026-02-13 cs.RO cs.AI cs.LG 83%

Humanoid Manipulation Interface: Humanoid Whole-Body Manipulation from Robot-Free Demonstrations

人形机器人操控接口:无需机器人演示的全身体验操控

Ruiqian Nai, Boyuan Zheng, Junming Zhao, Haodong Zhu, Sicong Dai, Zunhao Chen, Yihang Hu, Yingdong Hu, Tong Zhang, Chuan Wen, Yang Gao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 HuMI通过便携硬件实现无需机器人演示的全身体验操控,提升数据收集效率并提高未见环境中的任务成功率。

Comments Website: https://humanoid-manipulation-interface.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05844 2026-02-13 cs.GR cs.AI cs.RO 81%

DexterCap: An Affordable and Automated System for Capturing Dexterous Hand-Object Manipulation

DexterCap: 一种经济实惠且自动化的手部物体操作捕捉系统

Yutong Liang, Shiyi Xu, Yulong Zhang, Bowen Zhan, He Zhang, Libin Liu

机构 * Peking University(北京大学) School of Computer Science, Peking University(北京大学计算机学院) Tencent Robotics X(腾讯机器人实验室)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 DexterCap是一种低成本的自动化手部物体操作捕捉系统,通过字符编码标记和自动重建流程,实现稳健的跟踪和细粒度手部-物体交互数据集DexterHand的构建。

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11440 2026-02-13 cs.CV 79%

Ctrl&Shift: High-Quality Geometry-Aware Object Manipulation in Visual Generation

Ctrl&Shift: 视觉生成中高质量的几何感知物体操控

Penghui Ruan, Bojia Zi, Xianbiao Qi, Youze Huang, Rong Xiao, Pichao Wang, Jiannong Cao, Yuhui Shi

机构 * The Hong Kong Polytechnic University(香港理工大学) Southern University of Science and Technology(南方科技大学) The Chinese University of Hong Kong(香港中文大学) IntelliFusion Inc.(IntelliFusion公司) University of Electronic Science and Technology of China(电子科技大学) NVIDIA

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.CV

AI总结 Ctrl&Shift通过端到端扩散框架实现高质量几何感知物体操控,无需显式3D建模,兼顾细粒度控制与现实泛化能力。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05379 2026-02-13 cs.RO cs.SY eess.SY 79%

ETHOS: A Robotic Encountered-Type Haptic Display for Social Interaction in Virtual Reality

ETHOS:一种用于虚拟现实中社交互动的机器人遇发型触觉显示

Eric Godden, Jacquie Groenewegen, Matthew K. X. J. Pan

专题命中 机器人操作 :robotic(title,abstract);分类 cs.RO

AI总结 ETHOS是一种用于虚拟现实中社交互动的遇发型触觉显示系统,通过动态触觉反馈和安全机制实现自然物理接触。

Comments This work was combined with another paper that extends the technical characterization of our system to include an experiential evaluation through a user study. The combined work creates a unified representation of our contributions. With the combined paper to be published, this work is not longer needed

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11643 2026-02-13 cs.RO cs.AI cs.CV 75%

ViTaS: Visual Tactile Soft Fusion Contrastive Learning for Visuomotor Learning

ViTaS: 用于视觉-运动学习的视觉触觉软融合对比学习

Yufeng Tian, Shuiqi Cheng, Tianming Wei, Tianxing Zhou, Yuanhang Zhang, Zixian Liu, Qianwei Han, Zhecheng Yuan, Huazhe Xu

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 ViTaS通过融合视觉和触觉信息,利用软融合对比学习提升视觉-运动学习的性能。

Comments Published to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12096 2026-02-13 cs.RO cs.AI 73%

Multi Graph Search for High-Dimensional Robot Motion Planning

多图搜索用于高维机器人运动规划

Itamar Mishani, Maxim Likhachev

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本文提出多图搜索算法,用于高维机器人运动规划,通过多图扩展实现高效且可靠的路径搜索。

Comments Submitted for Publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11660 2026-02-13 cs.CV cs.RO 73%

Clutt3R-Seg: Sparse-view 3D Instance Segmentation for Language-grounded Grasping in Cluttered Scenes

Clutt3R-Seg:用于语言引导抓取的稀疏视角3D实例分割

Jeongho Noh, Tai Hyoung Rhee, Eunho Lee, Jeongyun Kim, Sunwoo Lee, Ayoung Kim

机构 * Dept. of Mechanical Engineering, SNU(机械工程系,首尔国立大学) Interdisciplinary Program in Artificial Intelligence, SNU(人工智能跨学科项目,首尔国立大学) Robotics Lab, Hyundai Motor Company(Hyundai Motor Company机器人实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 Clutt3R-Seg通过引入层次实例树和开放词汇语义嵌入,实现了在杂乱场景中语言引导抓取的高效3D实例分割。

Comments Accepted to ICRA 2026. 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12253 2026-02-13 cs.GT cs.LG 57%

Is Online Linear Optimization Sufficient for Strategic Robustness?

在线线性优化是否足以实现战略稳健性?

Yang Cai, Haipeng Luo, Chen-Yu Wei, Weiqiang Zheng

机构 * Yale University(耶鲁大学) University of Southern California(南加州大学) University of Virginia(弗吉尼亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 本文探讨在线线性优化算法是否足以实现投标算法的战略稳健性,并提出方法在已知和未知价值分布下均取得改进。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12142 2026-02-13 cond-mat.quant-gas cond-mat.str-el physics.atom-ph quant-ph 50%

Protocols for a many-body phase microscope: From coherences and d-wave superconductivity to Green's functions

多体相位显微镜的协议:从相干和d波超导到格林函数

Christof Weitenberg, Luca Asteria, Ola Carlsson, Annabelle Bohrdt, Fabian Grusdt

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出利用物质波显微镜通过傅里叶空间操控测量多体系统中长程非对角相关性,包括相位、相干及d波超导序参量等,揭示其在研究复杂量子态中的潜力。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12104 2026-02-13 q-fin.MF math.DS q-fin.TR 50%

Liquidation Dynamics in DeFi and the Role of Transaction Fees

去中心化金融中清算动态及交易费用的作用

Agathe Sadeghi, Zachary Feinstein

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了去中心化金融中清算动态及交易费用的作用,通过动态规划方法刻画最优清算策略,证明CPMM交易费用在保障安全性和补偿流动性提供者方面具有双重作用。

Comments 28 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11887 2026-02-13 cs.SE cs.CR 50%

Verifiable Provenance of Software Artifacts with Zero-Knowledge Compilation

基于零知识编译的软件制品可验证溯源

Javier Ron, Martin Monperrus

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出基于零知识虚拟机的编译方法,通过生成加密证明实现软件制品的可验证溯源,验证了其在现实软件中的应用及安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11772 2026-02-13 cs.SI math.OC 50%

Optimizing edge weights in the inverse eigenvector centrality problem

优化反向特征向量中心性问题中的边权重

Mauro Passacantando, Fabio Raciti

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出了一种优化方法,用于在有向图中根据给定的节点中心性分布确定边权重,通过不同策略比较加权网络结构的灵活性和应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06632 2026-02-13 quant-ph 50%

Normal mode splitting induced synchronization blockade in coupled quantum van der Pol oscillators

耦合量子范德波 oscillator 中正常模分裂诱导的同步阻塞

Nissi Thomas, M. Senthilvelan

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过耦合量子范德波振荡器中的正常模分裂机制,实现对量子同步的动态控制。

Comments 6 pages, 5 figures, accepted for publication in Physical Review A as a letter

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11421 2026-02-13 quant-ph cond-mat.mes-hall physics.optics 50%

Nonlinear integrated quantum photonics with AlGaAs

非线性集成量子光子学与AlGaAs

F. Baboux, G. Moody, S. Ducci

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文综述了AlGaAs在集成量子光子学中的应用,包括量子光源、光子电路和量子态工程,探讨了其在非线性光学和电光效应方面的优势及未来挑战。

Journal ref Optica 10, 917 (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10633 2026-02-13 cs.IR 50%

A Cognitive Distribution and Behavior-Consistent Framework for Black-Box Attacks on Recommender Systems

面向推荐系统黑盒攻击的认知分布与行为一致框架

Hongyue Zhang, Mingming Li, Dongqin Liu, Hui Wang, Yaning Zhang, Xi Zhou, Honglei Lv, Jiao Dai, Jizhong Han

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种认知分布与行为一致的黑盒攻击框架,通过引入认知分布驱动的提取机制和行为感知的噪声项生成策略,提升推荐系统攻击的成功率和隐蔽性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 14 篇

2602.11598 2026-02-13 cs.RO cs.AI cs.CV 83%

ABot-N0: Technical Report on the VLA Foundation Model for Versatile Embodied Navigation

ABot-N0:关于VLA基础模型在多功能具身导航中的技术报告

Zedong Chu, Shichao Xie, Xiaolong Wu, Yanfen Shen, Minghua Luo, Zhengbo Wang, Fei Liu, Xiaoxu Leng, Junjun Hu, Mingyang Yin, Jia Lu, Yingnan Guo, Kai Yang, Jiawei Han, Xu Chen, Yanqing Zhu, Yuxiang Zhao, Xin Liu, Yirong Yang, Ye He, Jiahang Wang, Yang Cai, Tianlin Zhang, Li Gao, Liu Liu, Mingchao Sun, Fan Jiang, Chiyu Wang, Zhicheng Liu, Hongyu Pan, Honglin Han, Zhining Gu, Kuan Yang, Jianfang Zhang, Di Jing, Zihao Guan, Wei Guo, Guoqing Liu, Di Yang, Xiangpo Yang, Menglin Yang, Hongguang Xing, Weiguo Li, Mu Xu

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 ABot-N0通过统一的VLA基础模型实现多功能具身导航,结合认知大脑与动作专家架构,在多个基准测试中超越专用模型,支持动态环境中的长周期任务。

Comments Project Page: https://amap-cvlab.github.io/ABot-Navigation/ABot-N0/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11862 2026-02-13 cs.RO 81%

LAMP: Implicit Language Map for Robot Navigation

LAMP:机器人导航的隐式语言地图

Sibaek Lee, Hyeonwoo Yu, Giseop Kim, Sunwook Choi

机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人学系,全北国立大学) NAVER LABS Department of Robotics and Mechatronics Engineering, DGIST(机器人与机电工程系,韩国科学技术院)

专题命中 具身导航 :navigation(title,abstract);robotics(comments,journal_ref);分类 cs.RO

AI总结 LAMP通过隐式语言地图实现高效机器人导航,结合隐式神经场与稀疏图进行粗到细路径优化,提升大环境下的内存效率和目标精度。

Comments Accepted for publication in IEEE Robotics and Automation Letters (RA-L). Project page: https://lab-of-ai-and-robotics.github.io/LAMP/

Journal ref IEEE Robotics and Automation Letters (RA-L), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12159 2026-02-13 cs.RO cs.AI 81%

3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting

3DGSNav: 通过主动3D高斯散射增强视觉-语言模型的物体导航

Wancai Zheng, Hao Chen, Xianlong Lu, Linlin Ou, Xinyi Yu

机构 * Zhejiang University of Technology, Hangzhou, China(浙江工业大学,杭州,中国) Zhejiang University, Hangzhou, China(浙江大学,杭州,中国)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 3DGSNav通过主动3D高斯散射提升视觉-语言模型的物体导航能力,结合结构化视觉提示和链式推理,实现高效且可靠的导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12074 2026-02-13 cs.RO 79%

RF-Modulated Adaptive Communication Improves Multi-Agent Robotic Exploration

基于RF调制的自适应通信提升多智能体机器人探索

Lorin Achey, Breanne Crockett, Christoffer Heckman, Bradley Hayes

机构 * University of Colorado Boulder(科罗拉多大学波尔德分校)

专题命中 具身导航 :robotic(title,abstract);分类 cs.RO

AI总结 本文提出了一种自适应射频传输算法,通过动态调节传输位置提升多智能体机器人在通信受限环境中的探索效率,实验显示其在距离和时间上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05447 2026-02-13 cs.CL cs.AI 79%

Structured Context Engineering for File-Native Agentic Systems: Evaluating Schema Accuracy, Format Effectiveness, and Multi-File Navigation at Scale

结构化上下文工程用于文件原生代理系统:评估模式准确性、格式有效性及大规模多文件导航

Damon McMillan

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 本研究评估了文件原生代理系统中结构化上下文工程的准确性、格式有效性及多文件导航,发现模型能力是影响性能的关键因素,架构选择需根据模型能力调整。

Comments 8 pages, 8 figures, 10 tables, 26 references. v2: revised scale experiment analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01501 2026-02-13 cs.RO cs.CV 73%

TreeLoc: 6-DoF LiDAR Global Localization in Forests via Inter-Tree Geometric Matching

TreeLoc: 通过树间几何匹配实现森林中的6自由度LiDAR全局定位

Minwoo Jung, Nived Chebrolu, Lucas Carvalho de Lima, Haedam Oh, Maurice Fallon, Ayoung Kim

机构 * Dept. of Mechanical Engineering, SNU(机械工程系,首尔国立大学) Oxford Robotics Institute, University of Oxford(牛津大学机器人研究所) CSIRO Robotics, DATA61, CSIRO and the School of Electrical Engineering and Computer Science, The University of Queensland (UQ)(CSIRO机器人、DATA61、CSIRO及昆士兰大学电气工程与计算机科学学院)

专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 TreeLoc通过树间几何匹配实现森林中的6自由度LiDAR全局定位,结合树干和DBH特征进行粗细匹配,并通过两步几何验证实现高精度定位。

Comments An 8-page paper with 7 tables and 8 figures, accepted to ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11541 2026-02-13 cs.AI cs.LG 62%

Budget-Constrained Agentic Large Language Models: Intention-Based Planning for Costly Tool Use

预算约束下的代理型大语言模型:基于意图的规划以应对昂贵的工具使用

Hanbing Liu, Chunhao Tian, Nan An, Ziyuan Wang, Pinyan Lu, Changyuan Yu, Qi Qi

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Shanghai University of Finance(上海财经大学) Baidu Inc.(百度公司)

专题命中 具身导航 :world model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出INTENT框架,通过意图感知的分层世界模型,在预算约束下提升工具使用任务的成功率并保持鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09255 2026-02-13 cs.RO cs.AI 62%

STaR: Scalable Task-Conditioned Retrieval for Long-Horizon Multimodal Robot Memory

STaR:可扩展的任务条件检索用于长时多模态机器人记忆

Mingfeng Yuan, Hao Zhang, Mahan Mohammadi, Runhao Li, Jinjun Shan, Steven L. Waslander

机构 * University of Toronto Institute for Aerospace Studies(多伦多大学航空航天研究所) University of Toronto Robotics Institute(多伦多大学机器人研究所) Department of Earth and Space Science(地球与空间科学系) Lassonde School of Engineering(拉索nde工程学院) York University(约克大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 STaR通过任务条件检索算法提升机器人长时多模态记忆的可扩展性和上下文推理能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11917 2026-02-13 cs.AI 57%

AlphaPROBE: Alpha Mining via Principled Retrieval and On-graph biased evolution

AlphaPROBE:通过原理性检索和图内偏见进化进行alpha因子挖掘

Taian Guo, Haiyang Shen, Junyu Luo, Binqi Chen, Hongjun Ding, Jinsheng Huang, Luchen Liu, Yun Ma, Ming Zhang

机构 * National Key Laboratory for Multimedia Information Processing, School of Computer Science, PKU-Anker LLM Lab, Peking University(国家多媒体信息处理重点实验室,计算机科学学院,PKU-Anker LLM实验室,北京大学) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) Baruch College, City University of New York(巴纳克学院,纽约城市大学)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 AlphaPROBE通过原理性检索和图内偏见进化,提升alpha因子挖掘的效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05014 2026-02-13 cs.AI cs.CL cs.IR 57%

DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search

DeepRead: 一种基于文档结构的推理以增强代理搜索

Zhanli Li, Huiwen Tian, Lvzhou Luo, Yixuan Cao, Ping Luo

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences, CAS(中国科学院大学) Wenlan School of Business, Zhongnan University of Economics(中南财经政法大学文澜商学院)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 DeepRead通过结构感知的文档推理增强代理搜索,有效提升文档理解精度。

Comments This version has significantly enhanced the clarity of our research

详情

展开后加载摘要…

URL PDF HTML 收藏