arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1216 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1216 篇

2410.12380 2025-07-15 cs.CL 70%

Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models

Amin Abolghasemi, Leif Azzopardi, Seyyed Hadi Hashemi, Maarten de Rijke, Suzan Verberne

机构 * Leiden University(莱顿大学) University of Strathclyde(斯特拉思克莱德大学) eBay Inc.(eBay公司) University of Amsterdam(阿姆斯特丹大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted at ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04854 2025-07-08 cs.CL 70%

$\textit{Grahak-Nyay:}$ Consumer Grievance Redressal through Large Language Models

Shrey Ganatra, Swapnil Bhattacharyya, Harshvivek Kashid, Spandan Anaokar, Shruti Nair, Reshma Sekhar, Siddharth Manohar, Rahul Hemrajani, Pushpak Bhattacharyya

机构 * Indian Institute of Technology Bombay(印度理工学院孟买学院) National Law School of India University(印度国家法律学校大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00352 2025-07-02 cs.SE cs.AI cs.ET 70%

An AST-guided LLM Approach for SVRF Code Synthesis

Abanoub E. Abdelmalak, Mohamed A. Elsayed, David Abercrombie, Ilhami Torunoglu

机构 * Calibre Yield Enhancement Services(Calibre 良率增强服务) Siemens EDA(西门子 EDA) Calibre Research & Development(Calibre 研究与开发) Calibre Product Management(Calibre 产品管理)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 9 Pages, 5 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18102 2025-06-24 cs.CL 70%

InspireDebate: Multi-Dimensional Subjective-Objective Evaluation-Guided Reasoning and Optimization for Debating

Fuyu Wang, Jiangtong Li, Kun Zhu, Changjun Jiang

机构 * Key Laboratory of Embedded System and Service Computing, Ministry of Education, Tongji University(嵌入式系统与服务计算重点实验室,教育部,同济大学) School of Computer Science and Technology, Tongji University(计算机科学与技术学院,同济大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 20 pages; Accepted to ACL 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17644 2025-06-24 cs.AI 70%

Measuring and Augmenting Large Language Models for Solving Capture-the-Flag Challenges

Zimo Ji, Daoyuan Wu, Wenyuan Jiang, Pingchuan Ma, Zongjie Li, Shuai Wang

机构 * Hong Kong University of Science and Technology(香港科技大学) D-INFK, ETH Zürich(ETH Zürich的D-INFK)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12066 2025-06-17 cs.CL 70%

Focusing on Students, not Machines: Grounded Question Generation and Automated Answer Grading

Gérôme Meyer, Philip Breuer

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07321 2025-06-13 cs.CL 70%

Benchmarking LLMs for Environmental Review and Permitting

Rounak Meyur, Hung Phan, Koby Hayashi, Ian Stewart, Shivam Sharma, Sarthak Chaturvedi, Mike Parker, Dan Nally, Sadie Montgomery, Karl Pazdernik, Ali Jannesari, Mahantesh Halappanavar, Sai Munikoti, Sameera Horawalavithana, Anurag Acharya

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) Iowa State University(爱荷华州立大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06015 2025-06-09 cs.IR 70%

On the Merits of LLM-Based Corpus Enrichment

Gal Zur, Tommy Mordo, Moshe Tennenholtz, Oren Kurland

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23299 2025-05-30 cs.CL 70%

Data-efficient Meta-models for Evaluation of Context-based Questions and Answers in LLMs

Julia Belikova, Konstantin Polev, Rauf Parchiev, Dmitry Simakov

机构 * Sber AI Lab(Sber AI实验室) Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19567 2025-05-27 cs.AI cs.MA 70%

LLM-Agent-Controller: A Universal Multi-Agent Large Language Model System as a Control Engineer

Rasoul Zahedifar, Sayyed Ali Mirghasemi, Mahdieh Soleymani Baghshah, Alireza Taheri

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19284 2025-05-27 cs.IR 70%

RankLLM: A Python Package for Reranking with LLMs

Sahel Sharifymoghaddam, Ronak Pradeep, Andre Slavescu, Ryan Nguyen, Andrew Xu, Zijian Chen, Yilin Zhang, Yidi Chen, Jasper Xian, Jimmy Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20006 2025-05-27 cs.IR 70%

Chatbot Arena Meets Nuggets: Towards Explanations and Diagnostics in the Evaluation of LLM Responses

Sahel Sharifymoghaddam, Shivani Upadhyay, Nandan Thakur, Ronak Pradeep, Jimmy Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments 10 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16102 2025-05-27 cs.CL 70%

Continually Self-Improving Language Models for Bariatric Surgery Question--Answering

Yash Kumar Atri, Thomas H Shin, Thomas Hartvigsen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Data and Code available at https://github.com/yashkumaratri/bRAGgen

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11651 2025-05-22 cs.IR cs.CV 70%

MIRACL-VISION: A Large, multilingual, visual document retrieval benchmark

Radek Osmulski, Gabriel de Souza P. Moreira, Ronay Ak, Mengyao Xu, Benedikt Schifferer, Even Oldridge

机构 * The Thørväld Group(Thørväld集团) Inria Paris-Rocquencourt(巴黎-罗克琴库尔Inria) Rajiv Gandhi University Doimukh(拉朱·甘地大学多伊穆克) Tsinghua University(清华大学) Palmer Research Laboratories(Palmer研究实验室) The Kumquat Consortium(Kumquat联盟)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07528 2025-05-13 cs.CL 70%

SEReDeEP: Hallucination Detection in Retrieval-Augmented Models via Semantic Entropy and Context-Parameter Fusion

Lei Wang

机构 * Hunan University(湖南大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04844 2025-05-09 cs.CL 70%

Osiris: A Lightweight Open-Source Hallucination Detection System

Alex Shan, John Bauer, Christopher D. Manning

机构 * Stanford University(斯坦福大学) Stanford HAI(斯坦福HAI)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Stanford 191W

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04784 2025-05-09 cs.CR cs.AI cs.CY 70%

A Proposal for Evaluating the Operational Risk for ChatBots based on Large Language Models

Pedro Pinacho-Davidson, Fernando Gutierrez, Pablo Zapata, Rodolfo Vergara, Pablo Aqueveque

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20368 2025-04-30 cs.MA cs.AI cs.LG 70%

AKIBoards: A Structure-Following Multiagent System for Predicting Acute Kidney Injury

David Gordon, Panayiotis Petousis, Susanne B. Nicholas, Alex A. T. Bui

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments Accepted at International Conference on Autonomous Agents and Multiagent Systems (AAMAS) Workshop, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14429 2025-04-22 cs.CV cs.AI 70%

ResNetVLLM-2: Addressing ResNetVLLM's Multi-Modal Hallucinations

Ahmad Khalil, Mahmoud Khalil, Alioune Ngom

机构 * University of Windsor(温莎大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00824 2025-04-04 cs.CL 70%

ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations

Yubo Wang, Xueguang Ma, Ping Nie, Huaye Zeng, Zhiheng Lyu, Yuxuan Zhang, Benjamin Schneider, Yi Lu, Xiang Yue, Wenhu Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05223 2025-03-27 cs.CL 70%

100% Elimination of Hallucinations on RAGTruth for GPT-4 and GPT-3.5 Turbo

Michael C. Wood, Adam A. Forbes

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16922 2025-03-24 cs.SE cs.AI 70%

RustEvo^2: An Evolving Benchmark for API Evolution in LLM-based Rust Code Generation

Linxi Liang, Jing Gong, Mingwei Liu, Chong Wang, Guangsheng Ou, Yanlin Wang, Xin Peng, Zibin Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12255 2025-03-18 cs.NI cs.AI cs.SI 70%

Agentic Search Engine for Real-Time IoT Data

Abdelrahman Elewah, Khalid Elgazzar

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09902 2025-03-14 cs.IR 70%

Conversational Gold: Evaluating Personalized Conversational Search System using Gold Nuggets

Zahra Abbasiantaeb, Simon Lupart, Leif Azzopardi, Jeffery Dalton, Mohammad Aliannejadi

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00686 2025-03-04 cs.SE cs.AI 70%

GPIoT: Tailoring Small Language Models for IoT Program Synthesis and Development

Leming Shen, Qiang Yang, Xinyu Huang, Zijing Ma, Yuanqing Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20196 2025-02-28 cs.CL 70%

ChineseEcomQA: A Scalable E-commerce Concept Evaluation Benchmark for Large Language Models

Haibin Chen, Kangtao Lv, Chengwei Hu, Yanshi Li, Yujin Yuan, Yancheng He, Xingyao Zhang, Langming Liu, Shilei Liu, Wenbo Su, Bo Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07238 2025-02-26 cs.CL 70%

OpenThaiGPT 1.5: A Thai-Centric Open Source Large Language Model

Sumeth Yuenyong, Kobkrit Viriyayudhakorn, Apivadee Piyatumrong, Jillaphat Jaroenkantasima

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 8 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10881 2025-02-18 cs.CL 70%

CiteCheck: Towards Accurate Citation Faithfulness Detection

Ziyao Xu, Shaohang Wei, Zhuoheng Han, Jing Jin, Zhe Yang, Xiaoguang Li, Haochen Tan, Zhijiang Guo, Houfeng Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07912 2025-02-13 cs.CL 70%

Elevating Legal LLM Responses: Harnessing Trainable Logical Structures and Semantic Knowledge with Legal Reasoning

Rujing Yao, Yang Wu, Chenghao Wang, Jingwei Xiong, Fang Wang, Xiaozhong Liu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02009 2025-02-05 cs.SE cs.AI cs.CR cs.LG 70%

LLMSecConfig: An LLM-Based Approach for Fixing Software Container Misconfigurations

Ziyang Ye, Triet Huynh Minh Le, M. Ali Babar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏