arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 3102 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 3102 篇

2606.06983 2026-06-08 eess.IV cs.AI cs.CV 新提交 57%

DaX: Learning General Pathology Representations Across Scales

DaX: 跨尺度的通用病理学表示学习

Bokai Zhao, Yiyang Zhang, Long Bai, Tai Ma, Hanqing Chao, Minfeng Xu

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Hupan Lab(虎斑实验室)

专题命中 评测与基准 :foundation model(abstract);分类 cs.AI

AI总结 提出病理视觉基础模型DaX,通过改进DINOv3自监督学习,结合连续放大训练、跨尺度组织视图等设计,在44个公开数据集的161项临床任务上取得最佳平均性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07020 2026-06-08 cs.CL 新提交 57%

MADE: Beyond Scoring via a Multilingual Agentic Diagnosing Engine for Fine-Grained Evaluation Insights

MADE:超越评分——通过多语言智能诊断引擎实现细粒度评估洞察

Yilun Liu, Miao Zhang, Shimin Tao, Minggui He, Chunguang Zhao, Chenxin Liu, Li Zhang, Chen Liu, Cheng Qian, Liqun Deng, Xiaojun Meng, Daimeng Wei

机构 * Huawei(华为)

专题命中 评测与基准 :LLM(abstract_cn);分类 cs.CL

AI总结 提出MADE多语言智能诊断引擎,将评估后分析分解为规划、聚合分析、实例检查、多语言文化反思和报告合成,在33个模型族、11个基准、26种语言等大规模设置下,诊断报告质量提升47%,专家偏好率达87.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06923 2026-06-08 cs.AI cs.SE 新提交 57%

Declarative Skills for AI Agents in Knowledge-Grounded Tool-Use Workflows

知识驱动工具使用工作流中AI代理的声明式技能

M. Danish Lim, I. Danial Bin Sharudin, Wen Han Chen, Cedric Lim, Laura Wynter

机构 * School of Computing and Information Systems(计算与信息系统学院) Singapore Management University(新加坡管理大学)

专题命中 评测与基准 :language model(abstract);分类 cs.AI

AI总结 提出声明式代理(通过自然语言技能文件控制流程)在知识密集型客服工作流中优于命令式状态机和无脚手架基线,但检索质量是主要瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27214 2026-08-28 cs.CV 新提交 50%

CODE: Cross-Modal Calibration and Dynamic Suppression for Open World Object Detection

CODE:面向开放世界目标检测的跨模态校准与动态抑制

Hao Xu, Zhaoning Shi, Hehe Jin, Bo Ma

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 评测与基准 :foundation model(abstract)

AI总结 本文针对开放世界目标检测的语义歧义与过度抑制问题,提出含三个互补组件的CODE框架,在真实世界检测基准上超越此前最优方法。

Comments Accepted by ACM Multimedia 2026 (MM '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27169 2026-08-28 cs.CV 新提交 50%

Ancient-Bench: A Comprehensive Multi-millennial, Multi-medium, and Multi-script Benchmark for Ancient Chinese Artifact Text Recognition

Ancient-Bench:用于中国古代文物文字识别的综合多千年、多介质、多文字基准数据集

Hiuyi Cheng, Nuo Xu, Yuyi Zhang, Xuhan Zheng, Wei Pan, Jing Zhang, Dezhi Peng, Minghui Liao, Yihua Teng, Jihao Wu, Haoyu Ren, Lianwen Jin

机构 * South China University of Technology(华南理工大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 评测与基准 :language model(abstract)

AI总结 针对现有古代文本基准数据集碎片化问题,推出Ancient-Bench基准数据集,含2700张图像,覆盖多千年、多介质、多文字,经实验发现古代文物文字识别仍存在异体字等挑战。

Comments Accepted by EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26866 2026-08-28 cs.CV 新提交 50%

Order Matters: A Chinese Multi-Panel Meme Benchmark for Vision-Language Reasoning

顺序很重要:面向视觉-语言推理的中文多面板梗图基准

Haihan Li, Haihao Li, Zhenfei Xu, Jize Qian

机构 * Shanghai Maritime University(上海海事大学) Dalian Maritime University(大连海事大学)

专题命中 评测与基准 :language model(abstract)

AI总结 该研究推出中文多面板梗图基准CMPM,评估大型视觉-语言模型对梗图的顺序感知推理能力,发现模型在打乱顺序时准确率大幅下降,Gemini 3.1 Pro和GPT-5.5表现优于开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25866 2026-08-27 cs.CV 新提交 50%

LUTSeg: A Longitudinal Multi-Expert Dataset for Ulcer Tissue Segmentation

LUTSeg:用于溃疡组织分割的纵向多专家数据集

Karen Sanchez, Carlos Hinojosa, Albert A. Ávila, Andrea C. Riano-Rojas, Diego H. Romero, Jenny C. Páez, Martina Llinás, Bernard Ghanem

机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) Subred Norte E.S.E, Hospital Simón Bolívar(北红区E.S.E西蒙·玻利瓦尔医院) Universidad del Rosario(罗萨里奥大学)

专题命中 评测与基准 :language model(abstract)

AI总结 研究针对慢性溃疡组织分割数据稀缺问题,构建LUTSeg数据集,并提出半监督框架TiSage,在低标注设置下优于基线方法。

Comments Published at ISIC in MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25674 2026-08-27 cs.RO 新提交 50%

Opportunities of Self Supervised Learning for GNSS: Evaluation of a Deep Learning-Enhanced PVT Algorithm

自监督学习在GNSS中的应用机会:深度学习增强型PVT算法的评估

Thomas Barbero, Bertrand Ekambi

机构 * Abbia GNSS Technologies(Abbia GNSS技术公司)

专题命中 评测与基准 :pretraining(abstract)

AI总结 本研究提出深度学习增强型PVT算法,结合监督目标与JEPA自监督预训练,在多驾驶场景评估中显著提升GNSS的PVT精度,尤其适用于恶劣城区,凸显未标注GNSS数据的泛化潜力。

Comments European Navigation Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24563 2026-08-26 cs.CV cs.RO 新提交 50%

X-MULTI: VLM-based Imaging Factor Disentanglement for Factor-Aware Image Synthesis

X-MULTI:基于VLM的成像因子解耦用于因子感知图像合成

Sonali Godavarthy, Matthias Neuwirth-Trapp, Tim-Felix Faasch, Maarten Bieshaar, Michael Moeller, Kristof Van Laerhoven, Danda Pani Paudel

机构 * University of Siegen(锡根大学) ETH Zürich(苏黎世联邦理工学院) Bosch Research(博世研究中心) INSAIT(INSAIT(保加利亚的智能与数据科学研究所)) Sofia University “St. Kliment Ohridski”(索非亚大学“圣·克利门特·奥赫里德斯基”)

专题命中 评测与基准 :language model(abstract)

AI总结 该研究针对文本到图像生成的成像因子解耦问题,提出基于VLM的X-MULTI方法及改进的I-FAA指标,提升了新颖因子组合的因子对齐效果与评估的稳健性。

Comments Accepted to the MUCG Workshop at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24094 2026-08-26 cs.RO 新提交 50%

SIREN-Bench: Behavior-Driven Generation and Evaluation of Emergency-Vehicle Interactions

SIREN-Bench:行为驱动的应急车辆交互生成与评估

Yicheng Zhu, Tianmu Zhao, Haoxin Leng, Fan Zuo, Tao Li, Zilin Bian

机构 * Rochester Institute of Technology(罗切斯特理工学院) CVS Health(CVS健康公司) City University of Hong Kong(香港城市大学) New York University(纽约大学)

专题命中 评测与基准 :language model(abstract)

AI总结 该研究提出行为驱动的SIREN协同仿真平台,构建SIREN-Bench-v1基准,经3类任务评估揭示不同行为模式下的失效特性,为自动驾驶与交通安全研究提供可扩展平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24043 2026-08-26 cs.CV 新提交 50%

ConsensusTAS: Self-Supervised Temporal Action Segmentation for Long-Horizon Construction Videos

ConsensusTAS:面向长时程施工视频的自监督时序动作分割

Xiaoshan Zhou, Yafei Sun

机构 * School of Project Management, University of Sydney(悉尼大学项目管理学院) School of Civil and Environmental Engineering, University of New South Wales(新南威尔士大学土木与环境工程学院)

专题命中 评测与基准 :language model(abstract)

AI总结 本研究提出自监督时序动作分割模型ConsensusTAS,无需标注且可在CPU运行,在公开数据集及真实施工视频上的性能优于现有最优方法,可用于人机协同与视频监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23845 2026-08-26 cs.CV 新提交 50%

Object Counting Across Modalities: Taxonomies, Benchmarks, Applications, and Open Challenges

跨模态物体计数:分类体系、基准、应用及开放挑战

Joana Konadu Owusu, Shivanand Venkanna Sheshappanavar

机构 * University of Wyoming(怀俄明大学) Geometric Intelligence Research Lab.(几何智能研究实验室)

专题命中 评测与基准 :prompting(abstract)

AI总结 本综述针对跨模态物体计数领域,提出五轴分类体系,梳理应用领域挑战,给出路线图,强调需构建稳健评估基础设施区分开放世界泛化与基准优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23302 2026-08-25 cs.CV 新提交 50%

Grounding Free-Form Instructions for Fashion Complementary Image Generation

基于自由形式指令的时尚互补图像生成的接地

Matteo Attimonelli, Claudio Pomo, Alessandro De Bellis, Danilo Danese, Dietmar Jannach, Tommaso Di Noia

机构 * Politecnico di Bari(巴里理工大学) Sapienza University of Rome(罗马大学) University of Klagenfurt(克拉根福大学)

专题命中 评测与基准 :language model(abstract)

AI总结 针对现有时尚互补图像生成基准的缺陷,该研究提出基于自由形式指令的新设置,用StyleFlow模型实现该任务,其生成的服装符合指令且风格连贯,同时降低了架构复杂度和推理成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23189 2026-08-25 cs.CV 新提交 50%

EchoWM: Open and Enterable Omnimodal World Models

EchoWM:开放且可进入的全模态世界模型

Songchun Zhang, Yaowei Li, Junhao Zhuang, Weiyang Jin, Haoyu Wang, Xin Lu, Yilang Sun, Shiyi Zhang, Haoran Li, Xiaoxiao Ma, Yuming Li, Yijun Liu, Yaofeng Su, Yanwen Ma, Haoyu Wu, Zihan Su, Yue Ma, Lvmin Zhang, Haoyang Huang, Zeyue Xue, Anyi Rao, Nan Duan

机构 * HKUST(香港科技大学) PKU(北京大学) Joy Future Academy, JD(京东探索研究院) HKU(香港大学) THU(清华大学) USTC(中国科学技术大学) FDU(复旦大学) Beihang University(北京航空航天大学) Stanford University(斯坦福大学)

专题命中 评测与基准 :post-training(abstract)

AI总结 该研究提出EchoWM全模态世界模型,围绕相机意图组织交互,构建互补数据引擎并采用渐进式训练等方法,在公开基准上实现强轨迹跟随与高视觉质量,支持跨视角交互及长序列多模态同步生成。

Comments 42 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22637 2026-08-25 cs.CV 新提交 50%

OmniCAD: A Large-Scale Benchmark for 3D Spatial Reasoning in Robotics Assemblies

OmniCAD:面向机器人装配任务的3D空间推理大规模基准测试集

Mingjia Wang, Taiting Lu, Ziwei Dong, Sisong Bei, Jingying Zeng, Runze Liu, Kaiyuan Lin, Hongxing Pan, Kai Zhang, Yizheng Hou, Yangshoudu Zheng, Chenchen Guo, Weiyuan Meng, Shubin Lyu, Zhijun Zheng, Dexu Wang, Xinyu Bai, Shurui Qian, Zhangzixin, Mengyu Pan, Guoliang Shi, Ling Ma, Yifan Yang, Qi He, Yi-Chao Chen, Yincheng Jin, Sung-Liang Chen, Mahanth Gowda

专题命中 评测与基准 :language model(abstract)

AI总结 本文提出OmniCAD——涵盖多类工业系统的3D空间推理大规模基准测试集,评估VLMs三类装配推理能力,发现当前VLMs在该任务中表现不佳,将开源相关资源推动该领域研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22366 2026-08-25 cs.CV 新提交 50%

When Do VLMs Help Arabic Manuscript OCR? A Cross-Dataset Study

视觉语言模型(VLMs)何时助力阿拉伯手稿光学字符识别(OCR)?一项跨数据集研究

Moshiur Farazi, Firoj Alam, Abderrahmane Maaradji, Zakaria Maamar, Hamdy Mubarak, Wajdi Zaghouani

机构 * Qatar Computing Research Institute(卡塔尔计算研究所) Hamad Bin Khalifa University(哈马德·本·哈利法大学) Northwestern University in Qatar(卡塔尔西北大学) University of Doha for Science Technology(多哈科技大学)

专题命中 评测与基准 :language model(abstract)

AI总结 本文通过跨8类阿拉伯语文本数据集的实验,探究VLMs对阿拉伯手稿OCR的助力场景,提出OCR先验可恢复性原则,支持构建自适应OCR-VLM工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20413 2026-08-24 q-bio.GN 新提交 50%

BioFirewall: A genome-writing-native governance layer for design-stage biosecurity screening of agentic AI

BioFirewall:面向智能体AI设计阶段生物安全筛查的基因组写入原生治理层

Anees Ahmed Mahaboob Ali, Radhakrishnan Delhibabu, Everette Jacob Remington Nelson

专题命中 评测与基准 :foundation model(abstract)

AI总结 针对智能体AI基因组编辑设计阶段的生物安全管控缺口,提出BioFirewall中间件,其在多维度筛查中表现优于大模型,能有效抵御攻击且假拒绝率低,已开源并附带可复现基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21281 2026-08-24 cs.CV 新提交 50%

WildFin: An In-the-Wild Dataset for Fish Behavioral Recognition

WildFin:用于鱼类行为识别的野外数据集

Abigail G. Grassick, Jerome Tze-Hou Hsu, Ethan Lin, Ziang Liu, Max Whitton, Madelyn Hair, Liam Gutierrez, Haozheng Yu, Kristin Branson, Vivek Jayaraman, Michael A. Gil, Andrew M. Hein, Jennifer J. Sun

机构 * Cornell University(康奈尔大学) University of Colorado Boulder(科罗拉多大学博尔德分校) HHMI Janelia Research Campus(HHMI珍妮亚研究园区)

专题命中 评测与基准 :foundation model(abstract)

AI总结 针对复杂海洋环境中鱼类行为识别模型失效问题,推出WildFin野外数据集,经大规模整理标注后对视觉基础模型测试,发现其与现实需求存在显著差距。

Comments 31 pages, 4 figures ECCV Marine 26 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21098 2026-08-24 cs.CV 新提交 50%

When does fusing hand-crafted knowledge with learned representations pay? A cost-normalized benchmark of stacking, substitution, and interference

将手工知识与学习表示融合何时有效?一种针对堆叠、替代和干扰的成本归一化基准

Ahmad AlMughrabi, Albert Clop, Benjamin Busam, Ricardo Marques, Petia Radeva

机构 * Universitat de Barcelona(巴塞罗那大学) Technical University of Munich(慕尼黑工业大学) Universitat Pompeu Fabra(庞培法布拉大学)

专题命中 评测与基准 :pretraining(abstract)

AI总结 该研究以成本归一化基准分析手工知识与学习表示融合的效果,发现三种结果并提出可预测端到端增益的分解式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20317 2026-08-21 cs.IR 新提交 50%

Projecting BrowseComp-Plus onto ClimbMix: Toward More Realistic Corpora for Agentic Search

将BrowseComp-Plus映射到ClimbMix:构建更符合智能体搜索需求的真实语料库

Sahel Sharifymoghaddam, Lingwei Gu, Yijun Ge, Jimmy Lin

专题命中 评测与基准 :language model(abstract)

AI总结 该研究将BrowseComp-Plus的查询映射到NVIDIA的ClimbMix语料库,构建了与基准无关的映射流水线,生成57个有效查询,使智能体搜索难度向检索环节转移,发布了相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20107 2026-08-21 cs.CV 新提交 50%

BeyondMasks: Evaluating Causal and Physical Consistency in Video Object Removal

BeyondMasks:评估视频对象移除中的因果与物理一致性

Yigit Ekin, Enes Sanli, Aykut Erdem, Erkut Erdem, Aysegul Dundar

机构 * Bilkent University(毕尔肯大学) Koç University(科克大学) Hacettepe University(哈杰泰佩大学) KUIS AI Center(KUIS人工智能中心)

专题命中 评测与基准 :language model(abstract)

AI总结 该研究推出BeyondMasks基准及CORE评估协议,针对现有视频对象移除评估仅关注局部掩码保真度的问题,填补了视觉合理性与因果正确性的差距。

Comments ECCV 2026 Project Page: https://yigitekin.github.io/BeyondMasks/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19380 2026-08-21 cs.CV 新提交 50%

CAViAR: A Causal Video Dataset for Fine-Grained Accident Reasoning in Real-World Scenarios

CAViAR:用于真实场景细粒度事故推理的因果视频数据集

Sparsh Garg, Yi-Wen Chen, Vijay Kumar B G, Abhishek Aich

机构 * NEC Laboratories, America(美国NEC实验室)

专题命中 评测与基准 :language model(abstract)

AI总结 该研究推出人工标注的真实事故视频基准CAViAR,测试发现现有VLMs存在感知-推理差距,无法可靠将驾驶场景主体行为映射到责任类别。

Comments Accepted to ECCV 2026 Workshop DriveX

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19272 2026-08-21 astro-ph.IM astro-ph.CO astro-ph.GA 新提交 50%

The Cross-Survey Decade: A Call to Action

跨巡天十年:行动号召

Gioia Rau, Robert Benjamin, Federica Bianco, Ranga-Ram Chary, Andy Connolly, Cecilia Garraffo, Suvi Gezari, Leanne P. Guy, Željko Ivezić, Stephanie Juneau, Vicky Kalogera, Mansi M. Kasliwal, François Lanusse, Zack Li, Rachel Mandelbaum, Peter Melchior, Stella Offner, Antonella Palmese, Jason Rhodes, Edward Schlafly, Kartik Sheth, Rachel Street, Michael Troxel, Tony Tyson, Beth Willman, Michael Wood-Vasey, Yuanyuan Zhang

专题命中 评测与基准 :foundation model(abstract)

AI总结 本文呼吁构建跨巡天科学基础设施,围绕四大支柱推进,以实现三个旗舰巡天项目联合数据的科学价值,需多方协作且当下是行动的关键时机。

Comments 23 pages, 1 figure. Community perspective on cross-survey science infrastructure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18367 2026-08-20 eess.IV cs.CV 新提交 50%

Optic Disc Segmentation in Fundus Images: From Classical Image Processing and Deformable Models to Modern AI

眼底图像中的视盘分割:从经典图像处理与可变形模型到现代人工智能

Buket D. Barkana

专题命中 评测与基准 :foundation model(abstract)

AI总结 本综述梳理视盘分割技术从经典方法到现代AI方法的发展,总结核心原则,指出边界模糊等持续挑战,为该领域研究提供方法学参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18993 2026-08-20 cs.CV 新提交 50%

ForeSightGuide: An Anticipatory Framework toward Accurate and Low-Redundancy Guidance for the Visually Impaired

ForeSightGuide:面向视障人士的精准低冗余前瞻式导航框架

Zhiyuan Wang, Xu Li, Shikang Guo, Wei Meng, Quan Liu, Jie Zuo

专题命中 评测与基准 :language model(abstract)

AI总结 该研究针对视障人士出行的信息过载问题,提出前瞻式导航框架ForeSightGuide,结合语义理解与危险预测,在新数据集及公共基准上实现最优性能,冗余警报与漏险率表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18711 2026-08-20 cs.CV eess.SP 新提交 50%

EgoHRV: Continuous Heart Rate Variability Estimation from Egocentric Systems for Autonomic Response and Skill Assessment

EgoHRV:用于自主神经反应与技能评估的自我中心式系统的连续心率变异性估计

Berken Utku Demirel, Christian Holz

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 评测与基准 :pretraining(abstract)

AI总结 本文提出EgoHRV方法,利用自我中心头戴设备的凝视摄像头结合3D骨干网络与低-高分解模块等,实现从凝视视频中连续估计HRV与HR,在HR/HRV估计中达最优准确率,集成后使EgoExo4D熟练度估计器准确率提升17.8%

Comments Accepted to the European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17883 2026-08-19 cs.CV 新提交 50%

Improving Complex Moiré Removal with Generative Supervision

利用生成式监督改进复杂莫尔条纹去除

Xinyang Gu, Zhilu Zhang, Honglei Xu, Yanting Mei, Yukang Ding, Wangmeng Zuo

专题命中 评测与基准 :foundation model(abstract)

AI总结 本研究针对现有数据集难以覆盖真实场景复杂莫尔条纹的问题,提出生成式监督数据引擎,构建WildMoiré数据集,在多模型上验证其可提升复杂莫尔条纹去除性能。

Comments 14 pages, 5 figures. Project page: https://xinygu-pavo.github.io/WildMoire/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17502 2026-08-19 cs.SI cs.CY 新提交 50%

The Brazilian Vaccination Debate on YouTube: Topics, Perspectives, and Engagement Dynamics

YouTube上的巴西疫苗接种辩论:主题、观点与参与动态

Matheus S. Azevedo, Geovana S. de Oliveira, Andrea Failla, Alexandre M. de Sousa, Fabricio Murai, Ana Paula C. da Silva, Carlos H. G. Ferreira

专题命中 评测与基准 :language model(abstract)

AI总结 本研究以127万条巴西YouTube评论为数据集,整合多维度计算分析,揭示了巴西疫苗接种辩论的主题分布、动态变化及观众对创作者框架的重构机制。

Comments Accepted at ASONAM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17165 2026-08-19 cs.CV eess.IV 新提交 50%

Rapid Debris-Volume Estimation from Post-Hurricane Aerial Imagery

飓风后航拍图像的快速 debris 体积估算

Kooshan Amini, Jamie Ellen Padgett, Guha Balakrishnan

机构 * Rice University(莱斯大学) Ken Kennedy Institute(肯·肯尼迪研究所)

专题命中 评测与基准 :foundation model(abstract)

AI总结 该研究提出 DebrisHeightNet 网络,利用飓风后单次航拍 RGB 图像,结合 CW-LMF 等技术实现残骸体积快速估算,精度优于传统参数化方法,部署便捷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16843 2026-08-18 cs.RO 新提交 50%

Security of Foundation-Model-Powered Embodied Agents: Attack Surfaces, Attacks, Defenses, and Evaluation

基于基础模型的具身智能体的安全性:攻击面、攻击、防御与评估

Jiawei Liu, Jiacheng Guo, Tian Zhang, Yiwei Xu, Juan Wang, Jinlin Fan, Bowen Xiao

机构 * Wuhan University(武汉大学)

专题命中 评测与基准 :foundation model(abstract)

AI总结 该研究以信任边界为核心,针对基于基础模型的具身智能体安全,划分了五个层级与十二个攻击面,分析了58种攻击、61种防御的现状,指出部分领域研究不足并提出开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏