arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1212 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1212 篇

2509.10572 2025-09-23 cs.SE cs.AI cs.DB 73%

Quality Assessment of Tabular Data using Large Language Models and Code Generation

Ashlesha Akella, Akshar Kaul, Krishnasuri Narayanam, Sameep Mehta

机构 * IBM Research(IBM研究院)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.AI、cs.DB

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14436 2025-09-19 cs.IR cs.AI 73%

When Content is Goliath and Algorithm is David: The Style and Semantic Effects of Generative Search Engine

Lijia Ma, Juan Qin, Xingchen Xu, Yong Tan

机构 * Belk College of Business, University of North Carolina at Charlotte(北卡罗来纳州立大学查尔斯顿分校商学院) Faculty of Business for Science and Technology, School of Management, University of Science and Technology of China(中国科学技术大学管理学院科学技术商学院) Michael G. Foster School of Business, University of Washington(华盛顿大学Michael G. Foster商学院)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.AI

Comments 59 pages, 6 figures, 20 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14249 2025-09-19 cs.CL cs.AI 73%

Advancing Conversational AI with Shona Slang: A Dataset and Hybrid Model for Digital Inclusion

Happymore Masoka

机构 * Pace University(帕克大学) Seidenberg School of Computer Science and Information Systems(塞登堡计算机科学与信息系统学院)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13702 2025-09-18 cs.CL cs.AI 73%

DSCC-HS: A Dynamic Self-Reinforcing Framework for Hallucination Suppression in Large Language Models

Xiao Zheng

机构 * School of Computing and Technology(计算机学院) China University of Petroleum(中国石油大学) Qingdao(青岛)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20416 2025-08-29 cs.CL cs.AI 73%

DentalBench: Benchmarking and Advancing LLMs Capability for Bilingual Dentistry Understanding

Hengchuan Zhu, Yihuan Xu, Yichen Li, Zijie Meng, Zuozhu Liu

机构 * Zhejiang University(浙江大学) ZJU-Angelalign R&D Center for Intelligence Healthcare(浙江大学智能医疗研发中心)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17647 2025-08-26 cs.CL cs.DL cs.IR 73%

SurveyGen: Quality-Aware Scientific Survey Generation with Large Language Models

Tong Bao, Mir Tafseer Nayeem, Davood Rafiei, Chengzhi Zhang

机构 * Nanjing University of Science and Technology(南京理工大学) University of Alberta(阿尔伯塔大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

Journal ref EMNLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13816 2025-08-20 cs.CL cs.AI 73%

The illusion of a perfect metric: Why evaluating AI's words is harder than it looks

Maria Paz Oliva, Adriana Correia, Ivan Vankov, Viktor Botev

机构 * Iris AI Borgen, Norway(Iris AI 布尔根,挪威) Iris AI Neurobiology BAS Sofia, Bulgaria(Iris AI 神经生物学 BAS 萨福ia,保加利亚) Iris AI Sofia, Bulgaria(Iris AI 萨福ia,保加利亚)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 1 figure. Accepted to RANLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07572 2025-08-12 cs.CL cs.AI 73%

WebWalker: Benchmarking LLMs in Web Traversal

Jialong Wu, Wenbiao Yin, Yong Jiang, Zhenglin Wang, Zekun Xi, Runnan Fang, Linhai Zhang, Yulan He, Deyu Zhou, Pengjun Xie, Fei Huang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01643 2025-08-05 cs.IR cs.CL 73%

ChEmbed: Enhancing Chemical Literature Search Through Domain-Specific Text Embeddings

Ali Shiraee Kasmaee, Mohammad Khodadad, Mehdi Astaraki, Mohammad Arshi Saloot, Nicholas Sherck, Hamidreza Mahyar, Soheila Samiee

机构 * Department of Computational Science and Engineering(计算科学与工程系) McMaster University(麦斯特大学) BASF Canada Inc(巴斯夫加拿大公司) BASF Corporation(巴斯夫公司)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05200 2025-07-24 cs.CL cs.AI cs.LG cs.NI 73%

ORANSight-2.0: Foundational LLMs for O-RAN

Pranshav Gajjar, Vijay K. Shah

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10577 2025-07-17 cs.CL cs.AI cs.CY 73%

Truth Sleuth and Trend Bender: AI Agents to fact-check YouTube videos and influence opinions

Cécile Logé, Rehan Ghori

机构 * Department of Computer Science Stanford University(计算机科学系 斯坦福大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07983 2025-07-11 cs.CL cs.AI 73%

Performance and Practical Considerations of Large and Small Language Models in Clinical Decision Support in Rheumatology

Sabine Felde, Rüdiger Buchkremer, Gamal Chehab, Christian Thielscher, Jörg HW Distler, Matthias Schneider, Jutta G. Richter

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10955 2025-07-11 cs.CL cs.AI 73%

Investigating Context-Faithfulness in Large Language Models: The Roles of Memory Strength and Evidence Style

Yuepei Li, Kang Zhou, Qiao Qiao, Bach Nguyen, Qing Wang, Qi Li

机构 * Department of Computer Science(计算机科学系) Iowa State University(爱荷华州立大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments This work is published at ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04942 2025-07-09 cs.CL cs.IR 73%

SIGIR 2025 -- LiveRAG Challenge Report

David Carmel, Simone Filice, Guy Horowitz, Yoelle Maarek, Oren Somekh, Ran Tavory, Mehdi Ghissassi, Edo Liberty, Roy Miara

机构 * Technology Innovation Institute (TII)(技术创新研究所) AI71 Pinecone

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

Comments 9 pages, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08324 2025-07-09 cs.CL cs.AI cs.LG 73%

Are LLMs Prescient? A Continuous Evaluation using Daily News as the Oracle

Hui Dai, Ryan Teehan, Mengye Ren

机构 * New York University(纽约大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00509 2025-07-02 cs.CL cs.AI 73%

TeamCMU at Touché: Adversarial Co-Evolution for Advertisement Integration and Detection in Conversational Search

To Eun Kim, João Coelho, Gbemileke Onilude, Jai Singh

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23139 2025-07-01 cs.CL cs.AI 73%

Benchmarking Deep Search over Heterogeneous Enterprise Data

Prafulla Kumar Choubey, Xiangyu Peng, Shilpa Bhagavath, Kung-Hsiang Huang, Caiming Xiong, Chien-Sheng Wu

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14949 2025-06-30 cs.CV cs.AI cs.CL cs.HC cs.LG 73%

KITAB-Bench: A Comprehensive Multi-Domain Benchmark for Arabic OCR and Document Understanding

Ahmed Heakl, Abdullah Sohail, Mukul Ranjan, Rania Hossam, Ghazi Shazan Ahmad, Mohamed El-Geish, Omar Maher, Zhiqiang Shen, Fahad Khan, Salman Khan

机构 * MBZUAI(马尔瓦大学人工智能研究所) Monta AI(蒙塔人工智能) Linköping University(林雪平大学) Australian National University(澳大利亚国立大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 5 figures, ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17036 2025-06-25 cs.CL cs.AI 73%

Language Model Re-rankers are Fooled by Lexical Similarities

Lovisa Hagström, Ercong Nie, Ruben Halifa, Helmut Schmid, Richard Johansson, Alexander Junge

机构 * Chalmers University of Technology(楚德大学) University of Gothenburg(哥德堡大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) amass technologies(amass技术公司)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted to FEVER 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18628 2025-06-24 cs.AI cs.CL 73%

AggTruth: Contextual Hallucination Detection using Aggregated Attention Scores in LLMs

Piotr Matys, Jan Eliasz, Konrad Kiełczyński, Mikołaj Langner, Teddy Ferdinan, Jan Kocoń, Przemysław Kazienko

机构 * Department of Artificial Intelligence, Wroclaw Tech(华沙技术大学人工智能系)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments ICCS 2025 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13070 2025-06-17 cs.CL cs.AI cs.LG 73%

CHILL at SemEval-2025 Task 2: You Can't Just Throw Entities and Hope -- Make Your LLM to Get Them Right

Jaebok Lee, Yonghyun Ryu, Seongmin Park, Yoonjung Choi

机构 * Samsung Research(三星研究院)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments The 19th International Workshop on Semantic Evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12483 2025-06-17 cs.AI cs.CL 73%

MALM: A Multi-Information Adapter for Large Language Models to Mitigate Hallucination

Ao Jia, Haiming Wu, Guohui Yao, Dawei Song, Songkun Ji, Yazhou Zhang

机构 * Beijing Institute of Technology(北京理工大学) The Open University(开放大学) Beijing Information Science and Technology University(北京信息科技大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08500 2025-06-17 cs.CL cs.AI cs.LG 73%

DRAGged into Conflicts: Detecting and Addressing Conflicting Sources in Search-Augmented LLMs

Arie Cattan, Alon Jacovi, Ori Ram, Jonathan Herzig, Roee Aharoni, Sasha Goldshtein, Eran Ofek, Idan Szpektor, Avi Caciularu

机构 * Google Research(谷歌研究)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06539 2025-06-10 cs.CL cs.AI 73%

Beyond Facts: Evaluating Intent Hallucination in Large Language Models

Yijie Hao, Haofei Yu, Jiaxuan You

机构 * Emory University(埃默里大学) UIUC(伊利诺伊大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 main conference

Journal ref Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (ACL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02839 2025-06-04 cs.IR cs.AI 73%

DeepShop: A Benchmark for Deep Research Shopping Agents

Yougang Lyu, Xiaoyu Zhang, Lingyong Yan, Maarten de Rijke, Zhaochun Ren, Xiuying Chen

机构 * University of Amsterdam(阿姆斯特丹大学) Shandong University(山东大学) Baidu Inc.(百度公司) Leiden University(莱顿大学) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07637 2025-05-13 cs.CL cs.AI cs.LG 73%

Chronocept: Instilling a Sense of Time in Machines

Krish Goel, Sanskar Pandey, KS Mahadevan, Harsh Kumar, Vishesh Khadaria

机构 * ProjectEndgame

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 8 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02171 2025-05-06 cs.CL cs.AI 73%

A New HOPE: Domain-agnostic Automatic Evaluation of Text Chunking

Henrik Brådland, Morten Goodwin, Per-Arne Andersen, Alexander S. Nossum, Aditya Gupta

机构 * Centre for Artificial Intelligence Research, University of Agder(人工智能研究中心,阿格德大学) Norkart AS(Norkart公司)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments 10 pages, To be published in SIGIR25

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00506 2025-05-02 cs.CL cs.AI 73%

HalluMix: A Task-Agnostic, Multi-Domain Benchmark for Real-World Hallucination Detection

Deanna Emery, Michael Goitia, Freddie Vargus, Iulia Neagu

机构 * Quotient AI

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03727 2025-04-28 cs.CL cs.AI cs.LG 73%

FaithEval: Can Your Language Model Stay Faithful to Context, Even If "The Moon is Made of Marshmallows"

Yifei Ming, Senthil Purushwalkam, Shrey Pandit, Zixuan Ke, Xuan-Phi Nguyen, Caiming Xiong, Shafiq Joty

机构 * Salesforce AI Research(Salesforce AI研究院) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract);分类 cs.CL、cs.AI

Comments The conference version of this paper is published at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12408 2025-04-18 cs.IR cs.CL 73%

A Human-AI Comparative Analysis of Prompt Sensitivity in LLM-Based Relevance Judgment

Negar Arabzadeh, Charles L. A . Clarke

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract);分类 cs.IR、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏