arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 1216 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. RAG评测 1216 篇

2603.17773 2026-03-19 cs.CY cs.HC 67%

Large Language Models in Teaching and Learning: Reflections on Implementing an AI Chatbot in Higher Education

大语言模型在教学与学习中的应用:在高等教育中实施AI聊天机器人反思

Fiammetta Caccavale, Carina L. Gargalo, Julian Kager, Magdalena Skowyra, Steen Larsen, Krist V. Gernaey, Ulrich Krühne

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文探讨了在高等教育中实施增强型AI助手中的风险与挑战,通过实验评估了大语言模型对学习动机、教学质量及学生表现的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11073 2026-03-13 cs.SE 67%

Context Before Code: An Experience Report on Vibe Coding in Practice

上下文在代码之前:关于在实践中使用Vibe编码的经验报告

Md Nasir Uddin Shuvo, Md Aidul Islam, Md Mahade Hasan, Muhammad Waseem, Pekka Abrahamsson

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文报告了一个全栈团队在实践中应用Vibe编码构建多项目代理学习平台和学术检索增强生成系统,并探讨了生成代码在隔离约束和架构设计上的不足。

Comments 6 Pages, 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14878 2026-03-10 cs.HC 67%

InterMind: Doctor-Patient-Family Interactive Depression Assessment Empowered by Large Language Models

InterMind:由大型语言模型赋能的医生-患者-家庭交互式抑郁症评估系统

Zhiyuan Zhou, Jilong Liu, Sanwang Wang, Shijie Hao, Yanrong Guo, Richang Hong

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 InterMind利用大型语言模型,通过医生、患者和家庭的互动提升抑郁症评估的精确性和效率。

Comments Accepted at ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20799 2026-02-25 cs.SE 67%

Unseen-Codebases-Domain Data Synthesis and Training Based on Code Graphs

基于代码图的未见代码库数据合成与训练

Guangsheng Ou, Qiming Zhang, Sirong Chen, Anji Li, Dong Xu, Tiancheng Luo, Dekun Dai, Cuiyun Gao, Long Wang, Jun Zhou, Mingwei Liu, Zibin Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 提出UCD-Training框架,通过代码图构建和两阶段训练,提升模型对未见代码库的推理能力和数据合成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15567 2026-02-03 cs.CR cs.SE 67%

MalCVE: Malware Detection and CVE Association Using Large Language Models

MalCVE: 使用大语言模型进行恶意软件检测与CVE关联

Eduard Andrei Cristea, Petter Molnes, Jingyue Li

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 MalCVE利用大语言模型检测恶意软件并关联CVE,实现高准确率的恶意软件识别和漏洞关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22706 2026-02-02 cs.CR cs.SE 67%

RealSec-bench: A Benchmark for Evaluating Secure Code Generation in Real-World Repositories

RealSec-bench:一个评估现实世界仓库中安全代码生成的基准

Yanlin Wang, Ziyao Zhang, Chong Wang, Xinyi Xu, Mingwei Liu, Yong Wang, Jiachi Chen, Zibin Zheng

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 RealSec-bench是一个基于现实世界Java仓库构建的安全代码生成评估基准,通过多阶段流程和专家验证,评估5种LLM在功能正确性和安全性方面的表现。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12448 2026-01-30 cs.SE 67%

Evaluating Large Language Models for Time Series Anomaly Detection in Aerospace Software

评估大型语言模型在航空航天软件时间序列异常检测中的应用

Yang Liu, Yixing Luo, Xiaofeng Li, Xiaogang Dong, Bin Gu, Zhi Jin

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出ATSADBench基准,评估大型语言模型在航空航天软件时间序列异常检测中的性能,发现其在单变量任务表现良好,但多变量任务效果欠佳,且RAG策略可能加剧假警报问题。

Comments This paper has been accepted by ASE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10258 2026-01-29 cs.CV cs.MM 67%

XY-Cut++: Advanced Layout Ordering via Hierarchical Mask Mechanism on a Novel Benchmark

XY-Cut++: 一种基于新型基准的分层遮罩机制的高级布局排序方法

Shuai Liu, Youmeng Li, Jizeng Wei

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 XY-Cut++通过分层遮罩机制在新型基准上实现高级布局排序,提升文档阅读顺序恢复的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10718 2026-01-19 cs.AI cs.CL cs.IR cs.LG 67%

Japanese AI Agent System on Human Papillomavirus Vaccination: System Design

日本的人乳头瘤病毒疫苗人工智能代理系统:系统设计

Junyu Liu, Siwen Yang, Dexiu Ma, Qian Niu, Zequn Zhang, Momoko Nagai-Tanima, Tomoki Aoyama

机构 * Kyoto University(京都大学) University of Waterloo(滑铁卢大学) Texas Tech University(德克萨斯技术大学) The University of Tokyo(东京大学) USTC(中国科学技术大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

AI总结 本研究设计了一种双用途的人工智能代理系统,通过对话界面提供HPV疫苗信息并生成分析报告,有效应对疫苗犹豫问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10128 2026-01-16 cs.CE cond-mat.mtrl-sci cs.SE 67%

A Generalizable Framework for Building Executable Domain-Specific LLMs under Data Scarcity: Demonstration on Semiconductor TCAD Simulation

在数据稀缺条件下构建可执行领域特定大语言模型的通用框架:以半导体TCAD仿真为例

Di Wang, Zhenhua Wu, Yu Liu, Kai Chang, Shaohua Wu

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文提出一种通用框架,在数据稀缺条件下构建可执行的领域特定大语言模型,通过生成合成数据和代码优化流程,实现领域知识灌输和脚本可执行性提升。

Comments Submitted to Nature Computational Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00513 2026-01-05 cs.LG 67%

When Small Models Are Right for Wrong Reasons: Process Verification for Trustworthy Agents

当小模型适用于错误的原因:信任代理的过程验证

Laksh Advani

机构 * Laksh Advani

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文揭示小型语言模型在推理过程中的可靠性问题,提出推理完整性评分,并展示RAG提升推理质量而元认知可能损害性能,强调过程验证对可信代理的重要性。

Comments Accepted to Trustagent workshop AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13632 2025-12-16 cs.LG 67%

StutterFuse: Mitigating Modality Collapse in Stuttering Detection with Jaccard-Weighted Metric Learning and Gated Fusion

StutterFuse: 通过Jaccard加权度量学习和门控融合缓解语塞崩溃

Guransh Singh, Md Shah Fahad

机构 * Department of Computer Science, Birla Institute of Technology, Mesra(计算机科学系,比拉理工学院,梅斯拉)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 StutterFuse通过Jaccard加权度量学习和门控融合策略,有效缓解语塞检测中的模态崩溃问题,实现高精度多标签分类。

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23229 2025-12-16 cs.LG 67%

Citegeist: Automated Generation of Related Work Analysis on the arXiv Corpus

Citegeist: 在arXiv语料库上自动生成相关工作分析的应用程序

Claas Beger, Carl-Leander Henneking

机构 * Cornell University(康奈尔大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

AI总结 Citegeist通过动态RAG技术在arXiv语料库上自动生成相关工作分析,结合嵌入相似性匹配、总结和多阶段过滤,提供引用支持的输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06504 2025-12-09 cs.CR 67%

When Code Crosses Borders: A Security-Centric Study of LLM-based Code Translation

当代码跨越国界:一种以安全为中心的LLM代码翻译研究

Hailong Chang, Guozhu Meng, Shuhui Xiao, Kai Chen, Kun Sun, Yilin Li

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文研究了LLM在代码翻译中的安全风险,发现28.6%-45%的翻译引入新漏洞,并提出RAG策略降低漏洞率32.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16224 2025-11-24 cs.SE 67%

Beyond Code Similarity: Benchmarking the Plausibility, Efficiency, and Complexity of LLM-Generated Smart Contracts

超越代码相似性:评估LLM生成智能合约的可信度、效率和复杂性

Francesco Salzano, Simone Scalabrino, Rocco Oliveto, Remo Pareschi

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

AI总结 本文评估了LLM生成智能合约的可信度、效率和复杂性,发现检索增强生成显著提升了功能正确性,但生成代码仍需专家验证。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10240 2025-11-19 cs.AR cs.LG 67%

Graph Neural Networks Based Analog Circuit Link Prediction

Guanyuan Pan, Tiansheng Zhou, Jianxiang Zhao, Zhi Li, Yugui Lin, Bingtao Ma, Yaqi Wang, Pietro Liò, Shuai Wang

机构 * HDU-ITMO Joint Institute, Hangzhou Dianzi University(杭州电子科技大学信息处理联合研究所) Intelligent Information Processing Laboratory, Hangzhou Dianzi University(杭州电子科技大学智能信息处理实验室) Innovation Center for Electronic Design Automation Technology, Hangzhou Dianzi University(杭州电子科技大学电子设计自动化技术创新中心) School of Computer Science and Technology, South China Business College, Guangdong University of Foreign Studies(广东外语外贸大学南方商学院计算机科学与技术学院) Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Code and data will be made available on request to the corresponding author

Journal ref Pan, G., Zhou, T., Zhao, J., Li, Z., Lin, Y., Ma, B., ... & Wang, S. (2026). Graph Neural Networks Based Analog Circuit Link Prediction. Engineering Applications of Artificial Intelligence, 163, 113035

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14791 2025-11-04 cs.SE 67%

RepoScope: Leveraging Call Chain-Aware Multi-View Context for Repository-Level Code Generation

Yang Liu, Li Zhang, Fang Liu, Zhuohang Wang, Donglin Wei, Zhishuo Yang, Kechi Zhang, Jia Li, Lin Shi

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Accepted by ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12205 2025-11-04 cs.SE 67%

PredicateFix: Repairing Static Analysis Alerts with Bridging Predicates

Yuan-An Xiao, Weixuan Wang, Dong Liu, Junwei Zhou, Shengyu Cheng, Yingfei Xiong

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments 13 pages, 5 figures; accepted for ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20279 2025-10-27 cs.LG 67%

ResearchGPT: Benchmarking and Training LLMs for End-to-End Computer Science Research Workflows

Penghao Wang, Yuhao Zhou, Mengxuan Wu, Ziheng Qin, Bangyuan Zhu, Shengbin Huang, Xuanlei Zhao, Panpan Zhang, Xiaojiang Peng, Yuzhang Shang, Jianfei Yang, Zheng Zhu, Tianlong Chen, Zhangyang Wang, Kai Wang

机构 * NUS(国立新加坡大学) NTU(国立科技大学) SZTU(深圳技术大学) UCF(佛罗里达大学) GigaAI(GigaAI研究所) UNC(北卡罗来纳大学教堂山分校) UT Austin(得克萨斯大学奥斯汀分校)

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06255 2025-10-09 cs.CY 67%

Towards an Efficient, Customizable, and Accessible AI Tutor

Juan Segundo Hevia, Facundo Arredondo, Vishesh Kumar

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments AAAI - iRAISE 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03641 2025-10-07 cs.SE 67%

Generating High-Level Test Cases from Requirements using LLM: An Industry Study

Satoshi Masuda, Satoshi Kouzawa, Kyousuke Sezai, Hidetoshi Suhara, Yasuaki Hiruta, Kunihiro Kudou

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments 11pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22991 2025-09-30 cs.CL cs.AI cs.CV cs.IR cs.LG 67%

ADAM: A Diverse Archive of Mankind for Evaluating and Enhancing LLMs in Biographical Reasoning

Jasin Cekinmez, Omid Ghahroodi, Saad Fowad Chandle, Dhiman Gupta, Ehsaneddin Asgari

机构 * Qatar Computing Research Institute(卡塔尔计算研究所) Princeton University(普林斯顿大学) Virginia Tech(弗吉尼亚理工大学) Amity University(阿米蒂大学)

专题命中 RAG评测 :retrieval-augmented generation(abstract);分类 cs.IR、cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21263 2025-09-29 cs.CL cs.AI cs.DB 67%

RuCCoD: Towards Automated ICD Coding in Russian

Aleksandr Nesterov, Andrey Sakhovskiy, Ivan Sviridov, Airat Valiev, Vladimir Makharev, Petr Anokhin, Galina Zubkova, Elena Tutubalina

机构 * AIRI Sber AI Skoltech Sber AI Lab HSE University(HSE大学) Innopolis University(Innopolis大学) ISP RAS Research Center for Trusted AI(ISP RAS可信AI研究中心)

专题命中 RAG评测 :RAG(abstract);分类 cs.CL、cs.AI、cs.DB

Comments Accepted to EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18207 2025-09-23 cs.DL cs.LG 67%

BAGELS: Benchmarking the Automated Generation and Extraction of Limitations from Scholarly Text

Ibrahim Al Azher, Miftahul Jannat Mokarrama, Zhishuai Guo, Sagnik Ray Choudhury, Hamed Alhoori

机构 * Northern Illinois University(北伊利诺伊大学) University of North Texas(北德克萨斯大学)

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments 16 pages, 8 figures, Accepted to the 2025 Conference on Empirical Methods in Natural Language Processing (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11859 2025-09-23 cs.HC cs.CY 67%

SouLLMate: An Adaptive LLM-Driven System for Advanced Mental Health Support and Assessment, Based on a Systematic Application Survey

Qiming Guo, Jinwen Tang, Wenbo Sun, Haoteng Tang, Yi Shang, Wenlu Wang

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13103 2025-09-17 cs.SE 67%

Accelerating Discovery: Rapid Literature Screening with LLMs

Santiago Matalonga, Domenico Amalfitano, Jean Carlo Rossa Hauck, Martín Solari, Guilherme H. Travassos

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

Comments This version of the manuscript has been submitted to Empirical Software Engieering Journal for consideration

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11150 2025-08-18 cs.HC 67%

From Misunderstandings to Learning Opportunities: Leveraging Generative AI in Discussion Forums to Support Student Learning

Stanislav Pozdniakov, Jonathan Brazil, Oleksandra Poquet, Stephan Krusche, Santiago Berrezueta-Guzman, Shazia Sadiq, Hassan Khosravi

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Artificial Intelligence in Education (AIED 2025)

Journal ref Artificial Intelligence in Education. AIED 2025. Lecture Notes in Computer Science, vol 15882. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03558 2025-08-06 cs.PL 67%

SAGE-HLS: Syntax-Aware AST-Guided LLM for High-Level Synthesis Code Generation

M Zafir Sadik Khan, Nowfel Mashnoor, Mohammad Akyash, Kimia Azar, Hadi Kamali

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

Comments Accepted to the IEEE International Conference on Computer Design (ICCD 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12296 2025-07-17 cs.HC 67%

Humans are more gullible than LLMs in believing common psychological myths

Bevan Koopman, Guido Zuccon

专题命中 RAG评测 :retrieval-augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17311 2025-06-24 cs.CY 67%

Can Large Language Models Be Trusted Paper Reviewers? A Feasibility Study

Chuanlei Li, Xu Hu, Minghui Xu, Kun Li, Yue Zhang, Xiuzhen Cheng

专题命中 RAG评测 :retrieval augmented generation(abstract);RAG(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏