arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 983 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 图谱与结构化RAG 983 篇

2401.02333 2024-02-13 cs.LG cs.CL 70%

Beyond Extraction: Contextualising Tabular Data for Efficient Summarisation by Language Models

Uday Allu, Biddwan Ahmed, Vishesh Tripathi

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Submitted to IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05628 2024-01-17 cs.CL cs.CE cs.CY 70%

Glitter or Gold? Deriving Structured Insights from Sustainability Reports via Large Language Models

Marco Bronzini, Carlo Nicolini, Bruno Lepri, Andrea Passerini, Jacopo Staiano

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17449 2024-01-04 cs.DB 70%

DB-GPT: Empowering Database Interactions with Private Large Language Models

Siqiao Xue, Caigao Jiang, Wenhui Shi, Fangyin Cheng, Keting Chen, Hongjun Yang, Zhiping Zhang, Jianshan He, Hongyang Zhang, Ganglin Wei, Wang Zhao, Fan Zhou, Danrui Qi, Hong Yi, Shaodong Liu, Faqiang Chen

专题命中 图谱与结构化RAG :retrieval augmented generation(abstract);RAG(abstract);分类 cs.DB

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25339 2026-08-14 astro-ph.GA 版本更新 69%

A Unified [CII] Morpho-Kinematic Corpus for 31 Star-Forming Galaxies at z = 4.26-5.68: The High-z Kinematic Corpus Z1

统一 [CII] 运动学形态数据集:31 个 z=4.26-5.68 恒星形成星系的高红移运动学语料库 Z1

David C. Flynn

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 基于 ALPINE 巡天数据,构建了 31 个高红移恒星形成星系的 [CII] 形态运动学结构化数据集,包含旋转曲线、动力学质量及分类信息,并公开了多格式数据与示例分析。

Comments 8 pages, 4 tables, 3 figures. Data descriptor for the High-z Kinematic Corpus Z1, the fourth corpus in the EPS Research RAG Astrophysics Corpus Series. Corpus deposited at Zenodo DOI: 10.5281/zenodo.20369285. Jupyter notebooks and figures included as ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08462 2026-08-27 cs.CR cs.PL cs.SE 版本更新 67%

QLCoder: A Query Synthesizer For Static Analysis of Security Vulnerabilities

QLCoder:一种用于静态分析安全漏洞的查询生成器

Claire Wang, Ziyang Li, Saikat Dutta, Mayur Naik

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 QLCoder通过结合LLM与执行反馈,利用MCP接口生成有效的安全查询,有效检测漏洞。在111个Java项目中,53.4%的CVE被正确识别,优于仅使用Claude Code的10%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00964 2026-08-04 cs.CY 新提交 67%

Copyright Is the Headline; Capability Is the Blind Spot: AI Technology in the Book-Publishing Trade Press, November 2025--August 2026

版权是头条,能力是盲区:2025年11月—2026年8月图书出版行业媒体中的人工智能技术

Fred Zimmerman

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 本研究通过分析多国行业媒体的89篇文章,指出图书出版领域AI报道存在能力盲区,提出设立常设AI报道板块等改进建议。

Comments 7 pages, 2 figures. 15-page Supplemental Information, coded 89-item corpus, crosstabs, BibTeX database, and citation audit included as ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25182 2026-07-29 cs.CL cs.AI cs.IR 新提交 67%

TabRank: Chain-of-Thought Distillation for Table Re-Rankers

TabRank:表格重排器的思维链蒸馏

Adarsh Singh, Kushal Raj Bhandari, Jianxi Gao, Soham Dan, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学) Rensselaer Polytechnic Institute(伦斯勒理工学院) Scale AI

专题命中 图谱与结构化RAG :dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 研究针对表格检索训练推理重排器的问题,提出TabRank框架,通过构建数据集并探索两种训练紧凑推理模型的变体,经压力测试,该方法在多表格检索数据集上显著提升性能,有效推广到多表格推理。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12281 2026-07-21 cs.CV 版本更新 67%

Cognitive-YOLO: LLM-Driven Architecture Synthesis from First Principles of Data for Object Detection

认知YOLO:基于数据第一性原理的大语言模型驱动的架构合成用于目标检测

Jiahao Zhao

机构 * Xi’an University of Posts and Telecommunications(西安邮电大学)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 针对通用目标检测算法在垂直场景的问题,认知YOLO利用大语言模型与自主智能体协作,构建“分析-合成-编译”管道,合成轻量级模型,显著压缩参数数量,在mAP@0.5:0.95上表现良好,平衡了模型紧凑性和特征表示能力。

Comments 11 pages, 3 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14528 2026-06-25 cs.SE 67%

BugRepro: Enhancing Android Bug Reproduction with Domain-Specific Knowledge Integration

BugRepro: 通过领域特定知识整合提升Android bug重现

Hongrong Yin, Jinhong Huang, Yao Li, Yunwei Dong, Tao Zhang

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出BugRepro,通过整合领域知识提升Android应用bug重现的准确性和效率,实验表明其在S2R实体提取准确率和重现成功率上均显著优于现有方法。

Journal ref Autom Softw Eng 33, 89 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03374 2026-06-23 cs.RO 版本更新 67%

eMEM: A Hybrid Spatio-Temporal Memory System For Embodied Agents

eMEM:一种面向具身智能体的混合时空记忆系统

A. Haroon Rasheed, Maria Kabtoul

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 提出eMEM混合图记忆系统,通过多索引架构和分层整合管道实现具身智能体在空间、时间和语义上的高效记忆检索,并在ProcTHOR-10K基准测试中达到80.8加权平均分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23169 2026-06-09 q-bio.QM 版本更新 67%

PRAXIS: Case-distilled and code-verified AI agents for biological research

PRAXIS:用于生物学研究的案例提炼与代码验证的AI智能体

Zhenyu Ma, Yuyang Song, Chunyi Yang, Jingyi Zhu, Limei Xu, Min Xiao, Xukai Jiang

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 提出PRAXIS框架,通过文献学习和案例提炼将研究经验转化为结构化长期记忆,支持生物计算任务中的问题定义、对象验证、方法选择等,实验表明基于案例的学习提升了复杂生物研究任务的方法选择、错误抑制和工作流组织。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06093 2026-06-02 cs.DB cond-mat.mtrl-sci cs.AI cs.CL 67%

Language-Native Materials Processing Design by Lightly Structured Text Database and Reasoning Large Language Model

基于轻结构化文本数据库和推理大语言模型的自然语言材料加工设计

Yuze Liu, Zhaoyuan Zhang, Xiangsheng Zeng, Yihe Zhang, Leping Yu, Liu Yang, Lejia Wang, Xi Yu

机构 * State Key Laboratory of Advanced Materials for Intelligent Sensing, Key Laboratory of Organic Integrated Circuit, Ministry of Education & Tianjin Key Laboratory of Molecular Optoelectronic Sciences, Department of Chemistry, School of Science, Tianjin University(智能传感先进材料国家重点实验室、有机集成电路重点实验室、教育部、天津分子光电子科学重点实验室、化学系、天津大学) Language Intelligence Technology Co., Ltd.(语言智能技术有限公司) College of Intelligence and Computing, Tianjin University(智能与计算学院、天津大学) School of Materials and Chemical Engineering, Ningbo University of Technology(材料与化学工程学院、宁波工业大学)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI、cs.DB

AI总结 将材料合成规划重构为文本推理问题,通过轻结构化知识基底结合检索增强生成与经验增强推理,在氮化硼纳米片剥离中三轮迭代获得高质量协议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13111 2026-05-29 cs.CL cs.AI cs.IR 67%

CORE-T: COherent REtrieval of Tables for Text-to-SQL

CORE-T: 面向文本到SQL的表格连贯检索

Hassan Soliman, Vivek Gupta, Dan Roth, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab), Department of Computer Science TU Darmstadt and National Research Center for Applied Cybersecurity ATHENE, Germany(普适知识处理实验室(UKP实验室),计算机科学系 TU Darmstadt 和应用网络安全国家研究中心 ATHENE,德国) Arizona State University(亚利桑那州立大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 图谱与结构化RAG :dense retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 提出CORE-T框架,通过LLM生成元数据和预计算兼容性缓存,在无需训练的情况下从异构表集合中高效检索连贯可连接的表集合,提升表选择F1最多22.7点并减少40%的表数量。

Comments Preprint is revised and under review. Code and data available at: https://github.com/UKPLab/arxiv2026-core-t

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18153 2026-05-19 cs.SE 67%

Three Heads Are Better Than One: A Multi-perspective Reasoning Framework for Enhanced Vulnerability Detection

三个头比一个好:一种多视角推理框架以增强漏洞检测

Xin Peng, Bo Lin, Jing Wang, Xiaoling Li, Jun Ma, Jie Yu, Xiaoguang Mao, Shangwen Wang

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 本文提出ReasonVul,一种多视角推理框架,通过三个专门的LLM代理的认知协同,提高漏洞检测的准确性和全面性,其在PrimeVul数据集上实现了40.00%的PairAcc和72.52%的F1分数,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09304 2026-05-12 cs.SE cs.HC 67%

Generating Complex Code Analyzers from Natural Language Questions

从自然语言问题生成复杂代码分析器

Amirmohammad Nazari, Sadra Sabouri, Wang Bill Zhu, Robin Jia, Souti Chattopadhyay, Mukund Raghothaman

专题命中 图谱与结构化RAG :RAG(abstract,abstract_cn)

AI总结 本文提出Merlin系统,通过整合LLM与CodeQL,解决复杂代码分析问题,提升代码问题解答的准确性和效率。

Comments 12 pages, 8 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00943 2026-05-05 cs.RO 67%

ARIS: Agentic and Relationship Intelligence System for Social Robots

ARIS:面向社交机器人的代理与关系智能系统

Stavya Datta, Fucai Ke, Leimin Tian, Hamid Rezatofighi

机构 * Monash University(墨尔本大学)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 ARIS通过整合多模态推理、图基社会世界模型和检索增强生成技术,提升社交机器人在多轮交互和社会关系推理中的能力,实验显示其在智能感知和用户亲和力方面表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09515 2026-04-13 cs.SE 67%

When LLMs Lag Behind: Knowledge Conflicts from Evolving APIs in Code Generation

当LLM落后时:来自演进API的代码生成中的知识冲突

Ahmed Nusayer Ashik, Shaowei Wang, Tse-Hsun Chen, Muhammad Asaduzzaman, Yuan Tian

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文研究了API演变对LLM代码生成的影响,发现缺乏全面文档时LLM难以优先处理外部上下文,执行率仅42.55%,而结构化文档和大模型规模可提升至66.36%,但推理策略如Self-Reflection可进一步提升11%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03509 2026-04-07 physics.med-ph 67%

Applications of Large Language Models in Radiation Oncology: From Workflow Automation to Clinical Intelligence

大型语言模型在放射肿瘤学中的应用:从工作流自动化到临床智能

Yuzhen Ding, Jason Holmes, Yuexing Hao, Zhengliang Liu, Peilong Wang, Junjie Cui, Meiyun Cao, Caiwen Jiang, Shuoyang Wei, Lin Zhao, Chenbin Liu, Lian Zhang, Yunze Yang, Tianming Liu, Wei Liu

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文探讨了大型语言模型在放射肿瘤学中的应用,包括工作流自动化、临床智能及决策支持,展示了其在标准化命名、注册管理及放疗计划评估中的核心贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29093 2026-04-06 cs.CL cs.AI cs.IR 67%

APEX-EM: Non-Parametric Online Learning for Autonomous Agents via Structured Procedural-Episodic Experience Replay

APEX-EM:通过结构化程序-经验经验回放实现自主代理的非参数在线学习

Pratyay Banerjee, Masud Moshtaghi, Ankit Chadha

机构 * Amazon, AGI / Sunnyvale, USA(亚马逊 AGI / 美国森尼韦尔)

专题命中 图谱与结构化RAG :hybrid retrieval(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本文提出APEX-EM框架,通过结构化经验表示和PRGII工作流,实现自主代理的非参数在线学习,提升跨领域任务的性能。

Comments 17 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21018 2026-03-24 cs.IR cs.AI cs.DB cs.LG 67%

DSL-R1: From SQL to DSL for Training Retrieval Agents across Structured and Unstructured Data with Reinforcement Learning

DSL-R1:从SQL到DSL,通过强化学习在结构化和非结构化数据上训练检索代理

Yunhai Hu, Junwei Zhou, Yumo Cao, Yitao Long, Yiwei Xu, Qiyi Jiang, Weiyao Wang, Xiaoyu Cao, Zhen Sun, Yiran Zou, Nan Du

机构 * New York University(纽约大学) Matter Innovation Inc.(Matter创新公司) Thin Red Line(薄红线)

专题命中 图谱与结构化RAG :hybrid retrieval(abstract);分类 cs.IR、cs.AI、cs.DB

AI总结 本文提出DSL-R1框架,结合逻辑推理与语义匹配,通过强化学习优化DSL生成,提升检索性能,实现在结构化和非结构化数据上的改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18433 2026-03-20 cs.CR 67%

Prompt Control-Flow Integrity: A Priority-Aware Runtime Defense Against Prompt Injection in LLM Systems

提示控制流完整性:一种优先级感知的运行时防御,用于对抗LLM系统中的提示注入

Md Takrim Ul Alam, Akif Islam, Mohd Ruhul Ameen, Abu Saleh Musa Miah, Jungpil Shin

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出Prompt Control-Flow Integrity,一种优先级感知的运行时防御机制,通过结构化组合系统、开发者、用户和检索文档片段来防范提示注入攻击,实现零误报率和低开销。

Comments 4 Figures, 3 Tables, Submitted to the International Conference on Power, Electronics, Communications, Computing, and Intelligent Infrastructure 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14858 2026-03-06 astro-ph.HE astro-ph.IM 67%

Large Language Model-driven Analysis of General Coordinates Network (GCN) Circulars

基于大语言模型的通用坐标网络(GCN)圆周分析

Vidushi Sharma, Ronit Agarwala, Judith L. Racusin, Leo P. Singer, Tyler Barna, Eric Burns, Michael W. Coughlin, Dakota Dutko, Courey Elliott, Rahul Gupta, Ashish Mahabal, Nikhil Mukund

专题命中 图谱与结构化RAG :retrieval augmented generation(abstract);RAG(abstract)

AI总结 本文利用大语言模型自动解析GCN圆周,实现暂现体观测信息的高效提取与分类,准确率达97.2%。

Comments 21 pages, 11 figures, 7 tables. Published in ApJS

Journal ref The Astrophysical Journal Supplement Series, 2026, Volume 283, Number 1, Pages 30

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01175 2026-03-03 cs.AR cs.ET 67%

HAVEN: High-Bandwidth Flash Augmented Vector Engine for Large-Scale Approximate Nearest-Neighbor Search Acceleration

HAVEN:高带宽闪存增强向量引擎用于大规模近似最近邻搜索加速

Po-Kai Hsu, Weihong Xu, Qunyou Liu, Tajana Rosing, Shimeng Yu

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 HAVEN通过高带宽闪存增强GPU,实现大规模近似最近邻搜索加速,提升重新排序吞吐量和效率。

Comments *Po-Kai Hsu and Weihong Xu contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20810 2026-01-29 cs.SE cs.LG 67%

Context-Augmented Code Generation Using Programming Knowledge Graphs

基于编程知识图谱的上下文增强代码生成

Shahd Seddik, Fahd Seddik, Iman Saberi, Fatemeh Fard, Minh Hieu Huynh, Patanamon Thongtanunam

机构 * University of British Columbia(不列颠哥伦比亚大学) University of Melbourne(墨尔本大学)

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出编程知识图谱(PKG)和重排序机制,通过细粒度检索和减少幻觉,提升代码生成在复杂问题上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16458 2026-01-26 cs.SE cs.CR 67%

Bridging Expert Reasoning and LLM Detection: A Knowledge-Driven Framework for Malicious Packages

弥合专家推理与大语言模型检测:一种基于知识的恶意包检测框架

Wenbo Guo, Shiwen Song, Jiaxun Guo, Zhengzi Xu, Chengwei Liu, Haoran Ou, Mengmeng Ge, Yang Liu

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 IntelGuard通过整合专家推理与大语言模型,实现高准确率的恶意包检测,发现54个未报告恶意包。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15269 2026-01-22 cs.CR 67%

Lightweight LLMs for Network Attack Detection in IoT Networks

轻量级大语言模型用于物联网网络中的网络攻击检测

Piyumi Bhagya Sudasinghe, Kushan Sudheera Kalupahana Liyanage, Harsha S. Gardiyawasam Pussewalage

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出利用轻量级大语言模型结合QLoRA和RAG技术,实现高效的物联网网络攻击检测,展示在未知攻击类型上的零样本能力。

Comments 6 pages with 2 figures, This paper was accepted and presented at the 7th Computing, Communications and IoT Applications Conference (ComComAp 2025), held in Madrid, Spain, during 14th to 17th December 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14343 2026-01-22 cs.CR cs.SY eess.SY 67%

Rethinking On-Device LLM Reasoning: Why Analogical Mapping Outperforms Abstract Thinking for IoT DDoS Detection

重新思考设备端LLM推理:为什么类比映射优于抽象思维用于IoT DDoS检测

William Pan, Guiran Liu, Binrong Zhu, Qun Wang, Yingzhou Lu, Beiyu Lin, Rose Qingyang Hu

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出一种结合Co_T和RAG的物联网边缘DDoS检测框架,通过示例驱动推理提升小型ODLLMs在资源受限下的检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08109 2026-01-14 cs.DB cs.AI cs.IR cs.LG 67%

CSQL: Mapping Documents into Causal Databases

CSQL:将文档映射到因果数据库

Sridhar Mahadevan

机构 * Adobe Research and University of Massachusetts(Adobe研究院和马萨诸塞大学)

专题命中 图谱与结构化RAG :RAG(abstract);分类 cs.IR、cs.AI、cs.DB

AI总结 CSQL通过将文档转换为因果数据库,支持对文档集合的因果分析,能够回答‘为什么’的问题,并实现大规模语料库级别的因果查询和纵向分析。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17309 2025-12-22 cs.RO 67%

RecipeMasterLLM: Revisiting RoboEarth in the Era of Large Language Models

RecipeMasterLLM: 重新审视大语言模型时代的RoboEarth

Asil Kaan Bozcuoglu, Ziyuan Liu

机构 * Huawei Heisenberg Research Center (Munich)(华为海森堡研究中心(慕尼黑))

专题命中 图谱与结构化RAG :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 RecipeMasterLLM通过微调大语言模型实现自动化知识获取,提升机器人动作描述的准确性与一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05686 2025-12-08 eess.SY cs.SY 67%

LA-RL: Language Action-guided Reinforcement Learning with Safety Guarantees for Autonomous Highway Driving

LA-RL: 基于语言动作引导的安全强化学习用于自动驾驶高速公路驾驶

Yiming Shu, Jiahui Xu, Jiwei Tang, Ruiyang Gao, Chen Sun

专题命中 图谱与结构化RAG :retrieval augmented generation(abstract);RAG(abstract)

AI总结 LA-RL通过整合大语言模型的语义推理和改进的安全层,提升自动驾驶高速公路驾驶的效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏