arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1216 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1216 篇

2409.06595 2025-01-31 cs.CL 70%

GroUSE: A Benchmark to Evaluate Evaluators in Grounded Question Answering

Sacha Muller, António Loison, Bilel Omrani, Gautier Viaud

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Proceedings of the 31st International Conference on Computational Linguistics

Journal ref Proceedings of the 31st International Conference on Computational Linguistics (2025), pages 4510 to 4534, Abu Dhabi, UAE. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08137 2025-01-31 cs.IR 70%

Generative Information Retrieval Evaluation

Marwah Alaofi, Negar Arabzadeh, Charles L. A. Clarke, Mark Sanderson

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR

Comments This chapter is part of the book Information Access in the Era of Generative AI, co-edited by Chirag Shah and Ryen White

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17132 2025-01-29 cs.SE cs.CL 70%

ASTRAL: Automated Safety Testing of Large Language Models

Miriam Ugarte, Pablo Valle, José Antonio Parejo, Sergio Segura, Aitor Arrieta

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref The 6th ACM/IEEE International Conference on Automation of Software Test (AST 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11353 2025-01-22 cs.CL 70%

THaMES: An End-to-End Tool for Hallucination Mitigation and Evaluation in Large Language Models

Mengfei Liang, Archish Arun, Zekun Wu, Cristian Munoz, Jonathan Lutch, Emre Kazim, Adriano Koshiyama, Philip Treleaven

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments NeurIPS 2024 SoLaR (Socially Responsible Language Modelling Research ) Workshop

Journal ref NeurIPS Workshop on Socially Responsible Language Modelling Research 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09709 2025-01-17 cs.CY cs.AI 70%

CyberMentor: AI Powered Learning Tool Platform to Address Diverse Student Needs in Cybersecurity Education

Tianyu Wang, Nianjun Zhou, Zhixiong Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07663 2025-01-15 cs.CL 70%

Enhancing Talent Employment Insights Through Feature Extraction with LLM Finetuning

Karishma Thakrar, Nick Young

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04425 2025-01-09 cs.CL 70%

End-to-End Bangla AI for Solving Math Olympiad Problem Benchmark: Leveraging Large Language Model Using Integrated Approach

H. M. Shadman Tabib, Jaber Ahmed Deedar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref IJNLC,vol:13, Issue:5/6, page 49-59,2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17146 2024-12-24 cs.AI physics.flu-dyn 70%

LLM Agent for Fire Dynamics Simulations

Leidong Xu, Danyal Mohaddes, Yi Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments NeurIPS 2024 Foundation Models for Science Workshop (38th Conference on Neural Information Processing Systems). 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16176 2024-12-24 cs.SD cs.CL cs.LG eess.AS 70%

Efficient VoIP Communications through LLM-based Real-Time Speech Reconstruction and Call Prioritization for Emergency Services

Danush Venkateshperumal, Rahman Abdul Rafi, Shakil Ahmed, Ashfaq Khokhar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 15 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15258 2024-12-23 cs.CL cs.LG 70%

DisEmbed: Transforming Disease Understanding through Embeddings

Salman Faroz

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13582 2024-12-19 cs.CL 70%

EvoWiki: Evaluating LLMs on Evolving Knowledge

Wei Tang, Yixin Cao, Yang Deng, Jiahao Ying, Bo Wang, Yizhe Yang, Yuyue Zhao, Qi Zhang, Xuanjing Huang, Yugang Jiang, Yong Liao

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07724 2024-12-18 cs.CL 70%

Granite Guardian

Inkit Padhi, Manish Nagireddy, Giandomenico Cornacchia, Subhajit Chaudhury, Tejaswini Pedapati, Pierre Dognin, Keerthiram Murugesan, Erik Miehling, Martín Santillán Cooper, Kieran Fraser, Giulio Zizzo, Muhammad Zaid Hameed, Mark Purcell, Michael Desmond, Qian Pan, Zahra Ashktorab, Inge Vejsbjerg, Elizabeth M. Daly, Michael Hind, Werner Geyer, Ambrish Rawat, Kush R. Varshney, Prasanna Sattigeri

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10906 2024-12-17 cs.CL cs.CE cs.LG q-fin.CP 70%

SusGen-GPT: A Data-Centric LLM for Financial NLP and Sustainability Report Generation

Qilong Wu, Xiaoneng Xiang, Hejia Huang, Xuan Wang, Yeo Wei Jie, Ranjan Satapathy, Ricardo Shirota Filho, Bharadwaj Veeravalli

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03258 2024-12-17 cs.CL 70%

GraphInsight: Unlocking Insights in Large Language Models for Graph Structure Understanding

Yukun Cao, Shuo Han, Zengyi Gao, Zezhong Ding, Xike Xie, S. Kevin Zhou

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18947 2024-12-02 cs.LG cs.IR 70%

ICLERB: In-Context Learning Embedding and Reranker Benchmark

Marie Al Ghossein, Emile Contal, Alexandre Robicquet

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14272 2024-11-22 cs.CL 70%

Efficient Aspect-Based Summarization of Climate Change Reports with Small Language Models

Iacopo Ghinassi, Leonardo Catalano, Tommaso Colella

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref Proceedings of the Third Workshop on NLP for Positive Impact (2024) 123-139

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13226 2024-11-21 cs.CL 70%

AIDBench: A benchmark for evaluating the authorship identification capability of large language models

Zichen Wen, Dadi Guo, Huishuai Zhang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08348 2024-11-14 cs.CL 70%

Refining Translations with LLMs: A Constraint-Aware Iterative Prompting Approach

Shangfeng Chen, Xiayang Shi, Pu Li, Yinlin Li, Jingjing Liu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05349 2024-11-11 cs.AI cs.DC 70%

Enhancing Cluster Resilience: LLM-agent Based Autonomous Intelligent Cluster Diagnosis System and Evaluation Framework

Honghao Shi, Longkai Cheng, Wenli Wu, Yuhang Wang, Xuan Liu, Shaokai Nie, Weixv Wang, Xuebin Min, Chunlei Men, Yonghua Lin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01428 2024-11-11 cs.CL cs.CV 70%

Superhuman performance in urology board questions by an explainable large language model enabled for context integration of the European Association of Urology guidelines: the UroBot study

Martin J. Hetz, Nicolas Carl, Sarah Haggenmüller, Christoph Wies, Maurice Stephan Michel, Frederik Wessels, Titus J. Brinker

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Journal ref 10.1016/j.esmorw.2024.100078

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02657 2024-11-06 cs.CL 70%

Zebra-Llama: A Context-Aware Large Language Model for Democratizing Rare Disease Knowledge

Karthik Soman, Andrew Langdon, Catalina Villouta, Chinmay Agrawal, Lashaw Salta, Braian Peetoom, Gianmarco Bellucci, Orion J Buske

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 26 pages, 4 figures, 1 supplementary figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00294 2024-11-05 cs.CL 70%

LLM-Ref: Enhancing Reference Handling in Technical Writing with Large Language Models

Kazi Ahmed Asif Fuad, Lizhong Chen

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01073 2024-11-05 cs.LG cs.AI cs.CR 70%

AttackQA: Development and Adoption of a Dataset for Assisting Cybersecurity Operations using Fine-tuned and Open-Source LLMs

Varun Badrinath Krishna

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18792 2024-10-28 cs.CY cs.CL 70%

An LLM Agent for Automatic Geospatial Data Analysis

Yuxing Chen, Weijie Wang, Sylvain Lobry, Camille Kurtz

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12069 2024-10-17 cs.CL cs.CY cs.HC 70%

De-jargonizing Science for Journalists with GPT-4: A Pilot Study

Sachita Nishal, Eric Lee, Nicholas Diakopoulos

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted to Computation+Journalism Symposium 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06809 2024-10-10 cs.CL 70%

Not All Contexts Are Equal: Teaching LLMs Credibility-aware Generation

Ruotong Pan, Boxi Cao, Hongyu Lin, Xianpei Han, Jia Zheng, Sirui Wang, Xunliang Cai, Le Sun

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments Accepted to EMNLP 2024 Main Conference. Our code, benchmark, and models are available at https://github.com/panruotong/CAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03888 2024-09-25 cs.CL 70%

FaaF: Facts as a Function for the evaluation of generated text

Vasileios Katranidis, Gabor Barany

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL

Comments 14 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02711 2024-09-05 cs.AI 70%

Creating a Gen-AI based Track and Trace Assistant MVP (SuperTracy) for PostNL

Mohammad Reshadati

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02851 2024-08-23 cs.AI 70%

Natural Language Programming in Medicine: Administering Evidence Based Clinical Workflows with Autonomous Agents Powered by Generative Large Language Models

Akhil Vaid, Joshua Lampert, Juhee Lee, Ashwin Sawant, Donald Apakama, Ankit Sakhuja, Ali Soroush, Sarah Bick, Ethan Abbott, Hernando Gomez, Michael Hadley, Denise Lee, Isotta Landi, Son Q Duong, Nicole Bussola, Ismail Nabeel, Silke Muehlstedt, Silke Muehlstedt, Robert Freeman, Patricia Kovatch, Brendan Carr, Fei Wang, Benjamin Glicksberg, Edgar Argulian, Stamatios Lerakis, Rohan Khera, David L. Reich, Monica Kraft, Alexander Charney, Girish Nadkarni

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

Comments Figures: 5, Tables: 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02811 2024-08-07 cs.AI 70%

Development of REGAI: Rubric Enabled Generative Artificial Intelligence

Zach Johnson, Jeremy Straub

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏