arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1216 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1216 篇

2505.04388 2025-05-30 cs.CL cs.AI 62%

The Aloe Family Recipe for Open and Specialized Healthcare LLMs

Dario Garcia-Gasulla, Jordi Bayarri-Planas, Ashwin Kumar Gururajan, Enrique Lopez-Cuena, Adrian Tormos, Daniel Hinjos, Pablo Bernabeu-Perez, Anna Arias-Duart, Pablo Agustin Martin-Torres, Marta Gonzalez-Mallo, Sergio Alvarez-Napagao, Eduard Ayguadé-Parra, Ulises Cortés

机构 * Barcelona Supercomputing Center (BSC-CNS)(巴塞罗那超级计算中心(BSC-CNS)) Universitat Politècnica de Catalunya - Barcelona Tech (UPC)(加泰罗尼亚理工大学-巴塞罗那技术大学(UPC))

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments Follow-up work from arXiv:2405.01886

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19494 2025-05-27 cs.CL cs.IR 62%

Anveshana: A New Benchmark Dataset for Cross-Lingual Information Retrieval On English Queries and Sanskrit Documents

Manoj Balaji Jagadeeshan, Prince Raj, Pawan Goyal

机构 * Indian Institute of Technology, Kharagpur(印度理工学院,克拉格浦尔)

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11571 2025-05-20 cs.CL cs.IR cs.LG 62%

FaMTEB: Massive Text Embedding Benchmark in Persian Language

Erfan Zinvandi, Morteza Alikhani, Mehran Sarmadi, Zahra Pourbahman, Sepehr Arvin, Reza Kazemi, Arash Amini

机构 * MCINext Sharif University of Technology(谢里夫理工大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21716 2025-05-01 cs.RO cs.AI cs.CL 62%

LLM-Empowered Embodied Agent for Memory-Augmented Task Planning in Household Robotics

Marc Glocker, Peter Hönig, Matthias Hirschmanner, Markus Vincze

机构 * Automation and Control Institute, Faculty of Electrical Engineering, TU Wien(自动化与控制研究所,电气工程学院,维也纳技术大学) AIT Austrian Institute of Technology GmbH, Center for Vision, Automation and Control(奥地利技术研究所(AIT)有限公司,视觉、自动化与控制中心)

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted at Austrian Robotics Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18110 2025-04-23 cs.CL cs.IR 62%

Open-World Evaluation for Retrieving Diverse Perspectives

Hung-Ting Chen, Eunsol Choi

机构 * Department of Computer Science(计算机科学系) New York University(纽约大学)

专题命中 RAG评测 :retriever(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12170 2025-04-21 cs.CL cs.AI 62%

Where is the answer? Investigating Positional Bias in Language Model Knowledge Extraction

Kuniaki Saito, Kihyuk Sohn, Chen-Yu Lee, Yoshitaka Ushiku

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments Code is published at https://github.com/omron-sinicx/WhereIsTheAnswer

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16063 2025-04-18 cs.CL cs.AI 62%

Citation-Enhanced Generation for LLM-based Chatbots

Weitao Li, Junkai Li, Weizhi Ma, Yang Liu

专题命中 RAG评测 :retrieval augmented generation(abstract);分类 cs.CL、cs.AI

Journal ref Proc. 62nd ACL Vol. 1 Long Papers, Bangkok Thailand, pp. 1451-1466, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10179 2025-04-15 cs.AI cs.CL cs.ET 62%

The Future of MLLM Prompting is Adaptive: A Comprehensive Experimental Evaluation of Prompt Engineering Methods for Robust Multimodal Performance

Anwesha Mohanty, Venkatesh Balavadhani Parthasarathy, Arsalan Shahid

专题命中 RAG评测 :knowledge retrieval(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11989 2025-03-21 cs.CL cs.AI 62%

Applications of Large Language Model Reasoning in Feature Generation

Dharani Chandra

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

Comments I just updated the format of the references in the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02694 2025-03-07 cs.CL cs.AI 62%

HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly

Howard Yen, Tianyu Gao, Minmin Hou, Ke Ding, Daniel Fleischer, Peter Izsak, Moshe Wasserblat, Danqi Chen

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments ICLR 2025. Project page: https://princeton-nlp.github.io/HELMET/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00596 2025-03-04 cs.CL cs.AI cs.CR 62%

BadJudge: Backdoor Vulnerabilities of LLM-as-a-Judge

Terry Tong, Fei Wang, Zhe Zhao, Muhao Chen

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments Published to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16704 2025-02-25 cs.CL cs.AI 62%

Code Summarization Beyond Function Level

Vladimir Makharev, Vladimir Ivanov

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted to LLM4Code @ ICSE'25; 8 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13490 2025-02-20 cs.CL cs.AI 62%

What are Models Thinking about? Understanding Large Language Model Hallucinations "Psychology" through Model Inner State Analysis

Peiran Wang, Yang Liu, Yunfei Lu, Jue Hong, Ye Wu

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04095 2025-02-07 cs.CL cs.AI 62%

LLMs to Support a Domain Specific Knowledge Assistant

Maria-Flavia Lovin

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20550 2025-01-20 cs.SE cs.AI cs.CL 62%

LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation

Ziyao Zhang, Yanlin Wang, Chong Wang, Jiachi Chen, Zibin Zheng

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted by ISSTA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15265 2024-12-24 cs.CL cs.AI 62%

Chinese SafetyQA: A Safety Short-form Factuality Benchmark for Large Language Models

Yingshui Tan, Boren Zheng, Baihui Zheng, Kerui Cao, Huiyun Jing, Jincheng Wei, Jiaheng Liu, Yancheng He, Wenbo Su, Xiangyong Zhu, Bo Zheng, Kaifu Zhang

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04662 2024-12-18 cs.CL cs.AI 62%

Citekit: A Modular Toolkit for Large Language Model Citation Generation

Jiajun Shen, Tong Zhou, Yubo Chen, Kang Liu

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments 7 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11404 2024-12-17 cs.CL cs.AI 62%

Attention with Dependency Parsing Augmentation for Fine-Grained Attribution

Qiang Ding, Lvzhou Luo, Yixuan Cao, Ping Luo

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 7 figures, submitted to ACL ARR 2024 October

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08275 2024-11-14 cs.IR cs.CL 62%

A Large-Scale Study of Relevance Assessments with Large Language Models: An Initial Look

Shivani Upadhyay, Ronak Pradeep, Nandan Thakur, Daniel Campos, Nick Craswell, Ian Soboroff, Hoa Trang Dang, Jimmy Lin

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10774 2024-10-02 cs.CL cs.AI 62%

MiniCheck: Efficient Fact-Checking of LLMs on Grounding Documents

Liyan Tang, Philippe Laban, Greg Durrett

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13749 2024-09-24 cs.CL cs.AI q-fin.CP 62%

KodeXv0.1: A Family of State-of-the-Art Financial Large Language Models

Neel Rajani, Lilli Kiessling, Aleksandr Ogaltsov, Claus Lang

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04645 2024-08-12 cs.CL cs.AI cs.CY cs.RO 62%

Evaluating the Impact of Advanced LLM Techniques on AI-Lecture Tutors for a Robotics Course

Sebastian Kahl, Felix Löffler, Martin Maciol, Fabian Ridder, Marius Schmitz, Jennifer Spanagel, Jens Wienkamp, Christopher Burgahn, Malte Schilling

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments The article is an extended version of a paper presented at the International Workshop on AI in Education and Educational Research (AIEER) at ECAI-2024 (27th European Conference on Artificial Intelligence)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03562 2024-08-08 cs.CL cs.AI 62%

A Comparison of LLM Finetuning Methods & Evaluation Metrics with Travel Chatbot Use Case

Sonia Meyer, Shreya Singh, Bertha Tam, Christopher Ton, Angel Ren

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17987 2024-07-26 cs.CL cs.AI 62%

Multi-step Inference over Unstructured Data

Aditya Kalyanpur, Kailash Karthik Saravanakumar, Victor Barres, CJ McFate, Lori Moon, Nati Seifu, Maksim Eremeev, Jose Barrera, Abraham Bautista-Castillo, Eric Brown, David Ferrucci

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04455 2024-06-05 cs.CL cs.AI cs.LG 62%

Fortify the Shortest Stave in Attention: Enhancing Context Awareness of Large Language Models for Effective Tool Use

Yuhan Chen, Ang Lv, Ting-En Lin, Changyu Chen, Yuchuan Wu, Fei Huang, Yongbin Li, Rui Yan

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments ACL 2024 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01045 2024-06-04 cs.CL cs.AI 62%

Decompose, Enrich, and Extract! Schema-aware Event Extraction using LLMs

Fatemeh Shiri, Van Nguyen, Farhad Moghimifar, John Yoo, Gholamreza Haffari, Yuan-Fang Li

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13622 2024-05-24 cs.CL cs.IR 62%

Automated Evaluation of Retrieval-Augmented Language Models with Task-Specific Exam Generation

Gauthier Guinet, Behrooz Omidvar-Tehrani, Anoop Deoras, Laurent Callot

专题命中 RAG评测 :RAG(abstract);分类 cs.IR、cs.CL

Comments Proceedings of the 41st International Conference on Machine Learning (ICML), 29 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05741 2024-05-10 cs.CL cs.AI 62%

Can large language models understand uncommon meanings of common words?

Jinyang Wu, Feihu Che, Xinxin Zheng, Shuai Zhang, Ruihan Jin, Shuai Nie, Pengpeng Shao, Jianhua Tao

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09114 2024-02-27 cs.CL cs.AI cs.LG 62%

Ever: Mitigating Hallucination in Large Language Models through Real-Time Verification and Rectification

Haoqiang Kang, Juntong Ni, Huaxiu Yao

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10790 2024-02-22 cs.CL cs.AI cs.LG 62%

In Search of Needles in a 11M Haystack: Recurrent Memory Finds What LLMs Miss

Yuri Kuratov, Aydar Bulatov, Petr Anokhin, Dmitry Sorokin, Artyom Sorokin, Mikhail Burtsev

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI

Comments 11M tokens, fix qa3 min facts per task in Table 1

详情

展开后加载摘要…

URL PDF HTML 收藏