arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

共收录 7464 信号源:cs.CV, cs.AI, cs.LG

1. 视觉定位与Grounding 7464 篇

2608.19269 2026-08-26 cs.SE 版本更新 50%

What Does an Evaluation License? A Commit-Bound Census of Claim-Relative Inference in Inspect Evals

内部稳定,跨样本未识别:基准效应与排名的语义识别

Xi Qin

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究针对TraceElephant基准,揭示评估语义对结论的影响,通过分析F_asym、F_cc等的效应与排名,提出局部非蕴含见证及族索引审计方法。

Comments 31 pages; major revision; adds a commit-bound 124-unit Inspect Evals census, typed evidence-stopping taxonomy, executable claim-replay contract, full scientific appendix, and public reproducibility package

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06495 2026-08-26 cs.CL 版本更新 50%

ConstructCIE: A Dataset for Extracting Causal Information from Construction Accident Narratives

ConstructCIE:用于从施工事故叙述中提取因果信息的数据集

Hung Nguyen, Jaehoon Lee, Namgyun Kim, Kuan-Hao Huang

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究构建了用于提取施工事故因果信息的ConstructCIE数据集,评估了相关模型的性能,发现模型在精确跨度提取上存在局限,需强化领域基础与证据提取。

Comments Paper accepted by EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25647 2026-08-26 cs.CE 版本更新 50%

Smallholder Farmers on Remote Islands Receiving Retrieval-Grounded Multilingual LLM Assistance and Agronomic Advice

基于检索的多语言LLM辅助工具用于岛屿小农户

Nikolaos D. Tantaroudas, Ilias Karachalios, Andrew J. McCracken

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对偏远岛屿小农户获取农业建议困难且方言知识缺乏全球语料支持的问题,提出嵌入双语电商平台的对话AI助手Falco eleonorae,通过工具增强检索(MCP)获取本地化数据,实现可信的多语言、语音和图像交互。

Comments 13, 4

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13830 2026-08-26 cs.IR 版本更新 50%

A Tale of Two Graphs: Separating Knowledge Exploration from Outline Structure for Open-Ended Deep Research

双图之 tale:分离知识探索与大纲结构以实现开放性深度研究

Zhuofan Shi, Ming Ma, Zekun Yao, Fangkai Yang, Jue Zhang, Dongge Han, Victor Rühle, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出DualGraph架构,通过分离知识与写作结构,提升开放性深度研究的效率和深度,实验表明其在报告深度、广度和事实准确性上优于现有方法。

Comments 26 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22917 2026-08-25 cs.CL cs.IR 新提交 50%

TSWAP: A Multilingual Retrieval-Augmented Thai Wellness Advisor

TSWAP:多语言检索增强型泰国健康顾问

Pornthep Ukosaramig, Kobkrit Viriyayudhakorn

机构 * Digital Touch Point Co., Ltd.(数字触点有限公司) iApp Technology Co., Ltd.(iApp技术有限公司)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究提出多语言检索增强型泰国健康顾问TSWAP,基于泰国传统医学知识库,采用混合检索等技术,发布相关基准与日志,发现量化及强制检索的部署要点。

Comments 8 pages, 2 tables. Data and evaluation logs: https://huggingface.co/datasets/iapp/tswap-wellness-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22229 2026-08-25 cs.CL 新提交 50%

Grounded Normative Rule Generation with Structured Search

基于结构化搜索的接地规范规则生成

Fanqi Kong, Huaxiao Yin, Ruijie Zhang, Xiaoyuan Zhang, Yizhe Huang, Jian Gao, Shuo Chen, Song-Chun Zhu

机构 * Peking University(北京大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室、北京智源人工智能研究院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本研究提出GNRS-Search框架,将规范规则生成为接地规范规则合成问题,通过MCMC采样优化AOG,在两个基准上提升规则质量,为受监管环境的合规智能体提供基础范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22152 2026-08-25 cs.CL 新提交 50%

The Collaboration Tax: How Much LLM Multi-Agent Systems Pay to Coordinate

协作损耗:LLM多智能体系统协调时的性能损失有多大

Weixiang Sun, Zehong Wang, Hong Huang, Colby Nelson, Yanfang Ye

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究定义了LLM多智能体系统的协作损耗,揭示其随模型能力提升单调下降,可通过对话特征预测,提示干预可缩小差距,为优化多智能体协作提供了量化依据。

Comments EMNLP 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22135 2026-08-25 cs.IR 新提交 50%

GrOIL: Graph-Grounded Domain Ontology Induction with Constrained LLM Mediation

GrOIL:基于图的领域本体归纳与受限大语言模型调解

Maruf Ahmed Mridul, Abid Talukder, Oshani Seneviratne

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究提出GrOIL流程,以受限LLM调解的七阶段图基方法构建可审计OWL TBox,在人寿保险领域的基准测试中,其CQ覆盖率等指标优于LLM基线,可生成稳定领域表示。

Comments 12 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21612 2026-08-25 physics.optics 新提交 50%

Machine Learning to Foundation Models: Artificial Intelligence for Nanophotonic Modeling and Scientific Discovery

从机器学习到基础模型:用于纳米光子学建模与科学发现的人工智能

Chaobin Yang, Xueqing Liu, Yiqun Fu, Fengbo Zhou, Krzysztof Kempa, Stefano Anzellotti, Michael J. Naughton

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本综述梳理了纳米光子学领域AI从机器学习到基础模型的发展,介绍了相关平台、问题与方法,分析了当前基础模型的局限并展望了多模态模型的未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17795 2026-08-25 cs.CL 版本更新 50%

TraceSQL: Traceable Answerability Estimation for Reference-Free Text-to-SQL Verification

TraceSQL:无参考文本到SQL验证的可追踪答案性估计

Neelesh Kumar Shukla, Debasmita Panda, Srutanik Bhaduri, Aditya Banerjee, Vasu Rangarajan, Viji Krishnamurthy

机构 * Oracle Corporation(甲骨文公司)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 针对无参考文本到SQL验证的可追踪性不足问题,提出基于67种诊断特征的轻量模型TraceSQL,在BIRD数据集上优于基线模型,可提供可追溯的预测证据。

Comments 9 pages main paper with 6 pages supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23772 2026-08-25 cs.HC 版本更新 50%

PageGuide: Browser extension to assist users in navigating a webpage and locating information

PageGuide: 一款辅助用户在网页上导航和查找信息的浏览器扩展

Tin Nguyen, Thang T. Truong, Runtao Zhou, Trung Bui, Chirag Agarwal, Anh Totti Nguyen

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 PageGuide通过视觉叠加将LLM回答与HTML DOM结合,帮助用户快速定位信息、逐步指导操作并隐藏干扰内容,提升浏览效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10029 2026-08-25 cs.GT 版本更新 50%

Auditing Game-Theoretic Measures of Strategic Reasoning in LLMs

量子反应均衡作为战略成熟度的度量:理论与LLM评估中的验证

Mateo Pechon-Elkins, Jon Chun

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出基于量子反应均衡的理论框架,用于评估大型语言模型的战略成熟度,通过实验验证了模型在不同认知能力上的表现及参数估计的稳健性。

Comments v2: substantive self-correction of v1 against raw transcripts; title changed. Corrects game specs to the implemented games; exact equilibrium solve (conditional bluff rate 2/3, not 0.340); response-validity audit: parser-substituted defaults retract Kimi K2's profile; prompt-framing result reversed. Appendix itemizes all changes. Data: https://doi.org/10.5281/zenodo.21943627. 28 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20412 2026-08-24 q-bio.GN 新提交 50%

PEN-STACK: A non-fabricating tool layer for language-model agents in genome writing

PEN-STACK:用于基因组写作的语言模型智能体的非制造工具层

Anees Ahmed Mahaboob Ali, Radhakrishnan Delhibabu, Everette Jacob Remington Nelson

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本研究提出PEN-STACK工具层,为基因组写作的语言模型智能体提供可靠来源的工具,可消除数量伪造,经测试能提升生物安全,为智能体基因组工程系统提供了开源基底。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21035 2026-08-24 cs.RO 新提交 50%

TaPeR: Probabilistic Recovery of Sparse Task Precedence Graphs from a Handful of Demonstrations

TaPeR:从少量演示中概率恢复稀疏任务优先关系图

Adrian Röfer, Karla Stepanova, Abhinav Valada

机构 * University of Freiburg(弗莱堡大学) Czech Technical University(捷克技术大学) Czech Institute of Informatics, Robotics, and Cybernetics(捷克信息学、机器人学与控制论研究所)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 TaPeR方法仅用运动学图和物体位姿分布,从少量演示中恢复更准确的稀疏任务优先关系图,可生成机器人的多种有效执行顺序。

Comments 8 pages, 5 figures, 3 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20356 2026-08-24 cs.DB 新提交 50%

Disentangling Structure and Semantics: How Schema Representation Affects LLM-Based SQL Generation

解耦结构与语义:模式表示如何影响基于大语言模型(LLM)的SQL生成

Daniel Yitian Su, Sophie Yiran Su, Qiang Sun, Yihao Ding, Wei Liu

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文通过6×3析因实验发现,基于LLM的文本转SQL中,语义线索对性能的影响大于结构线索,有意义的标识符可弥补结构缺失,而丰富结构元数据无法改善名称不明确的情况。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19056 2026-08-24 math.AT 版本更新 50%

Relative Obstructions and Spectral Diagnostics for Sheaves on Cell Complexes

相对障碍与谱诊断:关于细胞复形上sheaves的分析

Shinobu Yokoyama

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出了一种基于sheaf理论和谱分析的框架,用于评估结构不一致的相对障碍,通过谱特征识别不一致的性质和位置。

Comments 8 pages. Presented at the Finland-Japan Workshop in Industrial and Applied Mathematics 2026. v3: Substantially revised and corrected. Previous claims on spectral interleavings and cone reduction are removed. The cone-kernel statement is recast via the standard mapping-cone long exact sequence, and the paper is reframed as a methodological and computational application

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22194 2026-08-24 math.OC 版本更新 50%

Stability Analysis of an Integrated Multistage Stochastic Programming and Markov Decision Process Problem

一个集成多阶段随机规划与马尔可夫决策过程问题的稳定性分析

Zhiyao Yang, Zhiping Chen, Huifu Xu

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 研究集成MSP-MDP框架下的动态决策过程,通过推导动态嵌套重构、函数性质及误差界来研究内、外生不确定性概率分布扰动下的稳定性,结果与现有不同,为相关模型提供新理论基础。

Comments 68 pages, revised manuscript with corrections and clarifications to the model formulation, theoretical analysis, proofs, and examples

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12536 2026-08-24 cs.DB cs.DS cs.IR 版本更新 50%

jXBW: A Compressed Index Enabling Structure-Aware JSONL Retrieval for Structured RAG

jXBW: 面向结构化RAG中结构感知JSONL检索的压缩索引

Yasuo Tabei

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 提出jXBW压缩索引,通过合并树表示、基于扩展Burrows-Wheeler变换的简洁树索引和三阶段子结构搜索算法,实现查询依赖的复杂度,在百万级JSONL数据集上比最强基线快16倍至2800倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19813 2026-08-21 eess.IV 新提交 50%

Energy-Mamba: A Physics-Constrained State-Space Model for Medical Image Classification

Energy-Mamba:用于医学图像分类的物理约束状态空间模型

Mohamed Mabrok, Yalda Zafari, Essam A. Rashed

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 Energy-Mamba将物理约束融入Mamba状态空间模型,解决医学图像分类的表征漂移问题,在四个医学图像数据集上以更少参数实现了最优分类性能。

Comments This paper was accepted to the MICCAI 2026 workshop MLMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19699 2026-08-21 cs.MA 新提交 50%

An Evidence-Grounded Multi-Agent System for High-Level Bio-Robot Design

一种基于证据的用于高层生物机器人设计的多智能体系统

Yujun Chen, Tianle Li, Jiayu Chen, Zhen Yin

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究提出基于 Qwen3.5-27B 的 micro_biorobot_agent 多智能体系统,用于高层生物机器人设计,在评估中得分领先,来源追踪检查可显著降低错误缺口。

Comments 15 pages, 2 figures, 9 tables, and 4 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19509 2026-08-21 cs.SE 新提交 50%

An Agentic RAG and Evaluation Framework for Assurance Case Generation: Industrial Use Case for the EU Cyber Resilience Act Compliance

用于保障案例生成的智能检索增强生成与评估框架:欧盟网络弹性法案合规性的工业用例

Fariz Ikhwantri, Iker Lasa Ojanguren, Dusica Marijan, Maria I. Maslioukova, José Arias Marin, Pavlos Kosmides

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究提出基于智能RAG的保障案例生成与评估框架,通过案例研究验证其可自动化欧盟网络弹性法案合规评定,减少人工并提升证据可追溯性。

Comments 6 pages, accepted at ISSRE 2026 (Industry track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17546 2026-08-21 cs.SE 版本更新 50%

REST API Testing with Verified LLM-Inferred Dependencies and Response-Driven Refinement

基于经验证的LLM推断依赖关系与响应驱动优化的REST API测试

Tu Nguyen, Thanh Nguyen, Huy Nguyen, Viet Nguyen, Tien N. Nguyen, Vu Nguyen

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出APIPilot框架,通过执行验证LLM推断的REST API依赖关系,结合响应驱动优化,在16个真实API上实现高覆盖率与成功率,优于现有基线。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15469 2026-08-21 cs.CY 版本更新 50%

Aspirational Affordances of AI

AI的抱负性可供性

Sina Fazelpour, Meica Magnani

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文引入抱负性可供性与抱负性伤害概念,分析AI对抱负性可供性的影响及相关风险,拓展AI伤害讨论范畴,以深化对AI塑造抱负的心理与社会意义的理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18085 2026-08-20 cs.CL 新提交 50%

Persona-Guided LLM Agents for Task-Oriented Dialogue

面向任务型对话的角色引导大语言模型智能体

Maryam Shoaeinaeini, Brent Harrison, A. B. Siddique

机构 * University of Kentucky(肯塔基大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 该研究构建无需训练的框架,通过三种情境评估多模型在SGD数据集上的表现,发现适应用户人格存在权衡,Try情境的线索式适应可更可靠实现感知人格的任务型对话。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02876 2026-08-19 cs.CL 版本更新 50%

Eval4Sim: An Evaluation Framework for Persona Simulation

Eval4Sim: 一种用于人设模拟的评估框架

Eliseo Bao, Anxo Perez, Javier Parapar, Xi Wang

机构 * University of Sheffield(谢菲尔德大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 Eval4Sim提出了一种评估框架,用于衡量模拟对话与人类对话模式的契合度,通过三个互补维度评估人设的忠实性、一致性和自然性。

Comments Accepted at CIKM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16303 2026-08-18 cs.CL 新提交 50%

FTA-Mem: Fact-Time-Affect Anchored Memory for Low-Density Long-Term Dialogue

FTA-Mem:面向低密度长期对话的事实-时间-情感锚定记忆

Chang Liu, Shuyi Zhang, Changsheng Ma, Yongfeng Tao, Minqiang Yang, Bin Hu

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出FTA-Mem结构化记忆框架,通过BWS形成情境片段并构建FTA单元,在ES-MemEval等数据集上提升了低密度长期对话的记忆问答性能,实现了证据保留与构建成本的有效权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16293 2026-08-18 cs.HC cs.GT cs.SY eess.SY 新提交 50%

Principled Authority Switching for Shared Autonomy in Human-Robot Teams

人机协作团队中共享自主的原则性权限切换

Sandeep Banik, Naira Hovakimyan

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出一种合作博弈论框架,用于解决人机共享自主中的权限切换问题,推导了线性二次系统下最优切换策略的闭式递推式,验证了其在不同系统场景下的有效性,揭示了人类适应性与自主效率的权衡。

Comments 8 pages, 7 figures, accepted at IEEE RO-MAN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16071 2026-08-18 cs.CL cs.IR 新提交 50%

Skill2Query: Exploiting Skill Structure to Generate Pseudo-Queries for Agent Skill Retrieval

Skill2Query:利用技能结构生成智能体技能检索的伪查询

Lihui Ding, Zihan Guo, Bingwei Lu, Chenyu Zhou, Yuanjian Zhou, Weinan Zhang, Jianghao Lin, Dongdong Ge

机构 * Fudan University(复旦大学) Sun Yat-sen University(中山大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 Skill2Query是利用技能知识图谱生成伪查询的框架,可提升多类检索性能,生成的训练数据表现最优,还能提高智能体任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15931 2026-08-18 cs.CL 新提交 50%

PLSQLBench: Benchmarking LLM Systems for Executable Procedural Database Programming

PLSQLBench:面向可执行过程式数据库编程的大语言模型系统基准测试

Marianne Menglin Liu, Leonid Boytsov, Daniel W. Peterson, Pramuditha Perera, Rongguang Wang, Sai Ashish Somayajula, Syed Hamza Rafique, Rohit Saini, Shubham Pathak, Sujeeth Bharadwaj, Tao Sheng, Graham Horwood, Fahad Shah, Ankan Bansal, Sujith Ravi, Dan Roth

机构 * Oracle AI, Turing Enterprise Inc(Oracle AI 图灵企业公司)

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本研究提出首个过程式数据库编程基准PLSQLBench,含2865个任务实例,经8个LLM实验发现其在多方面存在困难,工具增强智能体性能有提升但仍有差距,凸显了传统基准未覆盖的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16311 2026-08-18 cs.HC cs.GT cs.SY eess.SY math.DS 新提交 50%

$\texttt{Flip-Team}$: Cooperative Takeover Games with Stochastic Human Override

Flip-Team:带随机人工干预的协作接管游戏

Sandeep Banik, Naira Hovakimyan

专题命中 视觉定位与Grounding :grounding(abstract)

AI总结 本文提出带随机人工干预的协作博弈论框架,将共享自主系统的控制切换问题建模为利益一致的动态博弈,推导线性二次系统的最优切换策略闭式递推式,验证了其在不同系统下的有效性,揭示人类适应性与自主效率的权衡。

Comments 8 pages, 7 figures, accepted at IEEE CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏