arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1216 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1216 篇

2506.10175 2025-06-13 cs.CR 67%

AURA: A Multi-Agent Intelligence Framework for Knowledge-Enhanced Cyber Threat Attribution

Nanda Rani, Sandeep Kumar Shukla

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05185 2025-06-02 cs.CR 67%

PentestAgent: Incorporating LLM Agents to Automated Penetration Testing

Xiangmin Shen, Lingzhi Wang, Zhenyuan Li, Yan Chen, Wencheng Zhao, Dawei Sun, Jiashui Wang, Wei Ruan

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments 14 pages, 13 figures, AsiaCCS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19322 2025-05-27 cs.ET 67%

NextG-GPT: Leveraging GenAI for Advancing Wireless Networks and Communication Research

Ahmad M. Nazar, Mohamed Y. Selim, Daji Qiao, Hongwei Zhang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Accepted in International Conference on Computer Communications and Networks (ICCCN 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02324 2025-05-26 cs.CY 67%

From Course to Skill: Evaluating LLM Performance in Curricular Analytics

Zhen Xu, Xinjin Li, Yingqi Huan, Veronica Minaya, Renzhe Yu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05057 2025-05-21 cs.SE 67%

Towards Mitigating API Hallucination in Code Generated by LLMs with Hierarchical Dependency Aware

Yujia Chen, Mingyu Chen, Cuiyun Gao, Zhihan Jiang, Zhongqi Li, Yuchi Ma

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Accepted by FSE 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09436 2025-05-20 cs.LG cs.AI cs.CL cs.IR 67%

CXMArena: Unified Dataset to benchmark performance in realistic CXM Scenarios

Raghav Garg, Kapil Sharma, Karan Gupta

机构 * Sprinklr

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10581 2025-05-19 econ.GN q-fin.EC 67%

The Impact of Large Language Models on Task Automation in Manufacturing Services

Jochen Wulf, Juerg Meierhofer

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments arXiv admin note: text overlap with arXiv:2406.01407

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04869 2025-05-09 cs.HC 67%

From First Draft to Final Insight: A Multi-Agent Approach for Feedback Generation

Jie Cao, Chloe Qianhui Zhao, Xian Chen, Shuman Wang, Christian Schunn, Kenneth R. Koedinger, Jionghao Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments 14 pages, to be published at the 26th International Conference on Artificial Intelligence in Education (AIED '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02133 2025-05-06 cs.SE 67%

Enhancing LLM Code Generation: A Systematic Evaluation of Multi-Agent Collaboration and Runtime Debugging for Improved Accuracy, Reliability, and Latency

Nazmus Ashrafi, Salah Bouktif, Mohammed Mediani

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18369 2025-04-28 cs.CR cs.SE 67%

ThreMoLIA: Threat Modeling of Large Language Model-Integrated Applications

Felix Viktor Jedrzejewski, Davide Fucci, Oleksandr Adamov

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12931 2025-04-18 cs.HC 67%

Explainable AI in Usable Privacy and Security: Challenges and Opportunities

Vincent Freiberger, Arthur Fleig, Erik Buchmann

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Presented at the 5th CHI Workshop on Human-Centered Explainable AI (HCXAI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11505 2025-04-17 cs.SE 67%

eARCO: Efficient Automated Root Cause Analysis with Prompt Optimization

Drishti Goel, Raghav Magazine, Supriyo Ghosh, Akshay Nambi, Prathamesh Deshpande, Xuchao Zhang, Chetan Bansal, Saravan Rajmohan

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12217 2025-03-18 cs.CR cs.LG 67%

TFHE-Coder: Evaluating LLM-agentic Fully Homomorphic Encryption Code Generation

Mayank Kumar, Jiaqi Xue, Mengxin Zheng, Qian Lou

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13766 2025-03-12 cs.CV 67%

Visual Haystacks: A Vision-Centric Needle-In-A-Haystack Benchmark

Tsung-Han Wu, Giscard Biamby, Jerome Quenum, Ritwik Gupta, Joseph E. Gonzalez, Trevor Darrell, David M. Chan

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments Accepted to ICLR 2025; Project page: https://visual-haystacks.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00016 2025-02-10 cs.CY cs.HC 67%

Large Language Models for Education: ChemTAsk -- An Open-Source Paradigm for Automated Q&A in the Graduate Classroom

Ryann M. Perez, Marie Shimogawa, Yanan Chang, Hoang Anh T. Phan, Jason G. Marmorstein, Evan S. K. Yanagawa, E. James Petersson

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments 38 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14209 2024-12-30 cs.SE 67%

Agents4PLC: Automating Closed-loop PLC Code Generation and Verification in Industrial Control Systems using LLM-based Agents

Zihan Liu, Ruinan Zeng, Dongxia Wang, Gengyun Peng, Jingyi Wang, Qiang Liu, Peiyu Liu, Wenhai Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments 12 pages (references included), 6 figures and 3 tables. New version updated with fixed site and github repo and along with some minor adjustements

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05206 2024-12-09 cs.CL cs.AI cs.IR 67%

ConQRet: Benchmarking Fine-Grained Evaluation of Retrieval Augmented Argumentation with LLM Judges

Kaustubh D. Dhole, Kai Shu, Eugene Agichtein

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00495 2024-12-03 cs.GT cs.LG 67%

Rethinking Strategic Mechanism Design In The Age Of Large Language Models: New Directions For Communication Systems

Ismail Lotfi, Nouf Alabbasi, Omar Alhussein

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments submitted to IEEE IoTM

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14926 2024-10-22 cs.CE 67%

Aligning LLMs with Human Instructions and Stock Market Feedback in Financial Sentiment Analysis

Zijie Zhao, Roy E. Welsch

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15232 2024-10-21 cs.CL cs.AI cs.IR 67%

Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations

Yucheng Jiang, Yijia Shao, Dekun Ma, Sina J. Semnani, Monica S. Lam

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

Comments EMNLP 2024 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16605 2024-09-26 cs.CL cs.AI cs.IR cs.LG 67%

Evaluating and Enhancing Large Language Models for Novelty Assessment in Scholarly Publications

Ethan Lin, Zhiyuan Peng, Yi Fang

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07487 2024-09-17 q-fin.CP 67%

MoA is All You Need: Building LLM Research Team using Mixture of Agents

Sandy Chen, Leqi Zeng, Abhinav Raghunathan, Flora Huang, Terrence C. Kim

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01701 2024-06-21 cs.SE 67%

De-Hallucinator: Mitigating LLM Hallucinations in Code Generation Tasks via Iterative Grounding

Aryaz Eghbali, Michael Pradel

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10018 2024-06-17 cs.SE 67%

STALL+: Boosting LLM-based Repository-level Code Completion with Static Analysis

Junwei Liu, Yixuan Chen, Mingwei Liu, Xin Peng, Yiling Lou

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01768 2024-06-07 cs.NI cs.IT eess.SP math.IT 67%

TSpec-LLM: An Open-source Dataset for LLM Understanding of 3GPP Specifications

Rasoul Nikbakht, Mohamed Benzaghta, Giovanni Geraci

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16543 2024-05-22 cs.AR 67%

RTLFixer: Automatically Fixing RTL Syntax Errors with Large Language Models

Yun-Da Tsai, Mingjie Liu, Haoxing Ren

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04662 2024-05-21 cs.CR 67%

VulLibGen: Generating Names of Vulnerability-Affected Packages via a Large Language Model

Tianyu Chen, Lin Li, Liuchuan Zhu, Zongyang Li, Xueqing Liu, Guangtai Liang, Qianxiang Wang, Tao Xie

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments ACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12430 2024-02-27 cs.IR cs.AI cs.CL cs.LG 67%

Efficient Title Reranker for Fast and Improved Knowledge-Intense NLP

Ziyi Chen, Jize Jiang, Daqian Zuo, Heyi Tao, Jun Yang, Yuxiang Wei

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14480 2024-02-23 cs.SE 67%

MeTMaP: Metamorphic Testing for Detecting False Vector Matching Problems in LLM Augmented Generation

Guanyu Wang, Yuekang Li, Yi Liu, Gelei Deng, Tianlin Li, Guosheng Xu, Yang Liu, Haoyu Wang, Kailong Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17041 2026-07-02 cs.CL cs.IR 新提交 66%

MetaSyn: A Benchmark for LLM Agents on Meta-Analysis Articles from Nature Portfolio

对Nature Portfolio元分析文章进行LLM代理基准测试

Anzhe Xie, Weihang Su, Yujia Zhou, Yiqun Liu, Min Zhang, Qingyao Ai

机构 * Tsinghua University(清华大学)

专题命中 RAG评测 :RAG(abstract_cn);分类 cs.IR、cs.CL;retriever(comments)

AI总结 提出MetaSyn数据集,包含442篇专家策划的元分析,用于评估LLM代理在检索-筛选-综合全流程中的表现,发现当前系统在筛选阶段存在严重瓶颈。

Comments 17 pages, 8 figures, 11 tables. Code and evaluation: https://github.com/THUIR/MetaSyn Dataset: https://huggingface.co/datasets/THUIR/MetaSyn Model: https://huggingface.co/BFTree/MA-Retriever

详情

展开后加载摘要…

URL PDF HTML 收藏