arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

RAG / 检索增强生成

检索增强生成、向量检索、知识库问答和面向大模型的搜索系统。

共收录 4602 信号源:cs.IR, cs.CL, cs.AI, cs.DB

1. 检索器与排序 4602 篇

2602.16231 2026-02-19 cs.CV 50%

DataCube: A Video Retrieval Platform via Natural Language Semantic Profiling

DataCube: 通过自然语言语义分析实现的视频检索平台

Yiming Ju, Hanyu Zhao, Quanyue Ma, Donglin Hao, Chengwei Wu, Ming Li, Songjing Wang, Tengfei Pan

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 检索器与排序 :hybrid retrieval(abstract)

AI总结 DataCube通过自然语言语义分析实现视频检索,提供高效的视频处理和多维检索功能。

Comments This paper is under review for the IJCAI-ECAI 2026 Demonstrations Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16113 2026-02-19 cs.NE cs.LG 50%

Evolutionary Context Search for Automated Skill Acquisition

进化上下文搜索用于自动化技能获取

Qi Sun, Stefan Nielsen, Rio Yokota, Yujin Tang

机构 * Institute of Science Tokyo, Japan(东京科学研究院)

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 进化上下文搜索通过进化方法发现非显而易见的上下文配对,显著提升模型性能,为自动化技能获取提供高效替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15591 2026-02-18 cs.SE 50%

Req2Road: A GenAI Pipeline for SDV Test Artifact Generation and On-Vehicle Execution

Req2Road: 一个用于SDV测试资产生成和车载执行的生成式AI管道

Denesa Zyberaj, Lukasz Mazur, Pascal Hirmer, Nenad Petrovic, Marco Aiello, Alois Knoll

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出了一种生成式AI管道,用于SDV子系统的测试资产生成和车载执行,通过自动化生成Gherkin场景并验证其可执行性。

Comments accepted at CAiSE 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13418 2026-02-17 cs.LG 50%

Text Has Curvature

文本具有曲率

Karish Grover, Hanqing Zeng, Yinglong Xia, Christos Faloutsos, Geoffrey J. Gordon

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出Texture,一种文本原生的词级曲率信号,通过定义和应用曲率检测与利用,建立文本曲率范式,提升长上下文推断和生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01317 2026-02-10 cs.HC cs.CY 50%

DietGlance: Dietary Monitoring and Personalized Analysis at a Glance with Knowledge-Empowered AI Assistant

DietGlance: 通过知识增强的AI助手实现饮食监控与个性化分析

Zhihan Jiang, Running Zhao, Lin Lin, Yue Yu, Handi Chen, Xinchen Zhang, Xuhai Xu, Yifang Wang, Xiaojuan Ma, Edith C. H. Ngai

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 DietGlance利用知识增强的AI助手,通过眼镜实现日常饮食行为的自动监控和个性化分析,提供营养分析和饮食建议。

Comments 47 pages, 14 figures. Accepted by ACM Transactions on Computing for Healthcare

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06325 2026-02-09 cs.CR cs.SE 50%

Identifying Adversary Tactics and Techniques in Malware Binaries with an LLM Agent

利用LLM代理识别恶意软件二进制中的攻击战术与技术

Zhou Xuan, Xiangzhe Xu, Mingwei Zheng, Louis Zheng-Hua Tan, Jinyao Guo, Tiantai Zhang, Le Yu, Chengpeng Wang, Xiangyu Zhang

专题命中 检索器与排序 :dense retrieval(abstract)

AI总结 TTPDetect通过结合密集检索与LLM神经检索,利用LLM代理识别恶意软件二进制中的TTPs,实现高精度和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16956 2026-02-09 cs.SE cs.LG 50%

SpIDER: Spatially Informed Dense Embedding Retrieval for Software Issue Localization

SpIDER:面向软件问题定位的时空感知密集嵌入检索

Shravan Chaudhari, Rahul Thomas Jacob, Mononito Goswami, Jiajun Cao, Shihab Rashid, Christian Bock

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) AWS(亚马逊公司) AWS AI Labs(亚马逊人工智能实验室)

专题命中 检索器与排序 :dense retrieval(abstract)

AI总结 SpIDER通过结合LLM推理和图结构探索信息,提升代码库中相关代码单元的密集检索性能,实验显示在多个编程语言和基准测试中性能提升达13%。

Comments Initial preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12783 2026-02-09 cs.LG q-fin.ST stat.AP 50%

Credit Risk Estimation with Non-Financial Features: Evidence from a Synthetic Istanbul Dataset

利用非金融特征进行信用风险估计:来自合成伊斯坦布尔数据集的证据

Atalay Denknalbant, Emre Sezdi, Zeki Furkan Kutlu

机构 * Department of Computer Engineering(计算机工程系) Bahcesehir University(巴赫切希尔大学) Department of Big Data Analytics(大数据分析系) Department of Artificial Intelligence(人工智能系)

专题命中 检索器与排序 :retrieval augmented generation(abstract)

AI总结 本文通过合成伊斯坦布尔数据集,利用非金融行为属性提升信用风险评估的准确性,展示了替代金融数据在改善信贷评估中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02213 2026-02-09 cs.LG 50%

InstructLR: A Scalable Approach to Create Instruction Dataset for Under-Resourced Languages

InstructLR: 一种可扩展的方法,用于为资源匮乏语言创建指令数据集

Mamadou K. Keita, Sebastien Diarra, Christopher Homan, Seydou Diallo

机构 * Rochester Institute of Technology(罗切斯特理工学院) RobotsMali MALIBA-AI

专题命中 检索器与排序 :RAG(abstract)

AI总结 InstructLR通过结合LLM生成与双层质量过滤机制,为低资源语言创建高质量指令数据集,促进了三个多领域基准的建立。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05868 2026-02-06 cs.CR 50%

Persistent Human Feedback, LLMs, and Static Analyzers for Secure Code Generation and Vulnerability Detection

持久的人类反馈、LLMs和静态分析器用于安全代码生成和漏洞检测

Ehsan Firouzi, Mohammad Ghafari

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出了一种持久存储人类反馈的框架,以提升LLMs在安全代码生成和漏洞检测中的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05465 2026-02-06 cs.SE 50%

Can We Classify Flaky Tests Using Only Test Code? An LLM-Based Empirical Study

仅通过测试代码可以对不稳定测试进行分类吗?基于LLM的经验研究

Alexander Berndt, Vekil Bekmyradov, Rainer Gemulla, Marcus Kessel, Thomas Bach, Sebastian Baltes

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本研究探讨了仅通过测试代码是否能有效分类不稳定测试,发现LLM在无额外上下文时表现有限,需进一步结合检索增强生成等方法提升泛化能力。

Comments 10 pages, 3 figures, 7 tables, 33rd IEEE International Conference on Software Analysis, Evolution and Reengineering: Reproducibility Studies and Negative Results (SANER-RENE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00196 2026-02-03 q-fin.ST q-fin.PM 50%

Generative AI for Stock Selection

生成式AI用于股票选择

Keywan Christian Rasekhschaffe

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 生成式AI通过检索增强生成技术,从股票数据中自动发现经济动机特征,提升短期收益预测的夏普比率,展现可解释且高效的特征发现能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18759 2026-01-29 cs.HC 50%

UI Remix: Supporting UI Design Through Interactive Example Retrieval and Remixing

UI Remix:通过交互式示例检索与混搭支持 UI 设计

Junling Wang, Hongyi Lan, Xiaotian Su, Mustafa Doga Dogan, April Yi Wang

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 UI Remix 通过交互式示例检索与混搭,帮助终端用户更高效地进行移动UI设计,提升设计可控性与信任度。

Comments Accepted at the 31st International Conference on Intelligent User Interfaces (IUI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06201 2026-01-28 cs.LG 50%

K2-V2: A 360-Open, Reasoning-Enhanced LLM

K2-V2:一种360开放、推理增强的LLM

K2 Team, Zhengzhong Liu, Liping Tang, Linghao Jin, Haonan Li, Nikhil Ranjan, Desai Fan, Shaurya Rohatgi, Richard Fan, Omkar Pangarkar, Huijuan Wang, Zhoujun Cheng, Suqi Sun, Seungwook Han, Bowen Tan, Gurpreet Gosal, Xudong Han, Varad Pimpalkhute, Shibo Hao, Ming Shan Hee, Joel Hestness, Haolong Jia, Liqun Ma, Aaryamonvikram Singh, Daria Soboleva, Natalia Vassilieva, Renxi Wang, Yingquan Wu, Yuekai Sun, Taylor Killian, Alexander Moreno, John Maggs, Hector Ren, Guowei He, Hongyi Wang, Xuezhe Ma, Yuqi Wang, Mikhail Yurochkin, Eric P. Xing

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 检索器与排序 :knowledge retrieval(abstract)

AI总结 K2-V2是一种通过注入领域知识、推理、长上下文和工具使用能力,提升复杂推理任务性能的360开放LLM,具备强大的推理能力和开源训练资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12148 2026-01-27 cs.SE 50%

Many Hands Make Light Work: An LLM-based Multi-Agent System for Detecting Malicious PyPI Packages

众手成炬:基于LLM的多智能体系统用于检测恶意PyPI包

Muhammad Umar Zeshan, Motunrayo Ibiyo, Claudio Di Sipio, Phuong T. Nguyen, Davide Di Ruscio

专题命中 检索器与排序 :RAG(abstract)

AI总结 本文提出LAMPS,一种基于LLM的多智能体系统,通过协作检测恶意PyPI包,实现高准确率和显著的性能提升。

Comments The paper has been peer-reviewed and accepted for publication to the Journal of Systems and Software (https://www.sciencedirect.com/journal/journal-of-systems-and-software)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04259 2026-01-23 cs.HC cs.CY 50%

Cognitive AI framework 2.0: advances in the simulation of human thought

认知AI框架2.0:人类思维模拟的进展

Rommel Salas-Guerra

专题命中 检索器与排序 :retrieval augmented generation(abstract)

AI总结 认知AI框架2.0通过统一的记忆架构和受控的知识更新,提升人机交互的个性化与适应性,解决可扩展性、偏见缓解和伦理合规等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00526 2026-01-15 cs.LG cs.DC 50%

Federated Customization of Large Models: Approaches, Experiments, and Insights

联邦大模型定制化:方法、实验与洞察

Yuchuan Ye, Ming Ding, Youjia Chen, Peng Cheng, Dusit Niyato

机构 * College of Physics and Information Engineering, Fuzhou University(物理与信息工程学院,福州大学) Data61, CSIRO(Data61,CSIRO) Department of Computer Science and Information Technology, La Trobe University(计算机科学与信息科技系,拉筹夫大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文提出联邦学习中的大模型定制化方法,通过实验验证了前缀微调的有效性,展示了其在性能、效率和鲁棒性方面的竞争力。

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08036 2026-01-14 cs.SE 50%

Automating API Documentation from Crowdsourced Knowledge

从众包知识自动化生成API文档

Bonan Kou, Zijie Zhou, Muhao Chen, Tianyi Zhang

专题命中 检索器与排序 :dense retrieval(abstract)

AI总结 AutoDoc通过从Stack Overflow提取API知识,生成更准确、简洁且全面的API文档,有效解决官方文档过时和不完整的问题。

Comments 13 pages, 2 figures, Accepted to ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07252 2026-01-13 cs.MA 50%

SwarmFoam: An OpenFOAM Multi-Agent System Based on Multiple Types of Large Language Models

SwarmFoam: 基于多种大语言模型的开放FOAM多智能体系统

Chunwei Yang, Yankai Wang, Jianxiang Tang, Haojie Qu, Ziqiang Zou, YuLiu, Chunrui Deng, Zhifang Qiu, Ming Ding

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 SwarmFoam通过整合多模态感知与智能校正技术,提升复杂CFD模拟的适应性与准确性。

Comments 26 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03812 2025-12-30 physics.med-ph cs.NA math.NA 50%

Impact of friction force and retrieval speed on in silico mechanical thrombectomies: a sensitivity analysis

摩擦力和取栓速度对计算机机械取栓的影响:灵敏度分析

Mahesh S. Nagargoje, Virginia Fregona, Giulia Luraghi, Francesco Migliavacca, Demitria A Poulos, Bryan C Good, Jose Felix Rodriguez Matas

专题命中 检索器与排序 :retriever(abstract)

AI总结 研究探讨了摩擦力和取栓速度对机械取栓模拟的影响,发现摩擦系数和取栓速度变化会显著影响取栓效果,强调了准确计算摩擦因子在计算机模拟中的重要性。

Journal ref Computer Methods and Programs in Biomedicine 271 (2025) 109018

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03632 2025-12-30 physics.med-ph 50%

The role of friction forces in arterial mechanical thrombectomy: a review

摩擦力在动脉机械取栓中的作用:综述

Mahesh S. Nagargoje, Virginia Fregona, Giulia Luraghi, Francesco Migliavacca, Guglielmo Pero, Jose Felix Rodriguez Matas

专题命中 检索器与排序 :retriever(abstract)

AI总结 本文综述了摩擦力在动脉机械取栓中的作用,指出富含纤维蛋白的血栓因摩擦系数高而更难取出,强调深入理解摩擦力对优化取栓技术的重要性。

Journal ref Journal of Biomechanics 192 (2025) 112966

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20535 2025-12-24 cs.CR 50%

ARBITER: AI-Driven Filtering for Role-Based Access Control

ARBITER: 基于人工智能的基于角色的访问控制过滤

Michele Lorenzo, Idilio Drago, Dario Salvadori, Fabio Romolo Vayr

专题命中 检索器与排序 :RAG(abstract)

AI总结 ARBITER通过基于LLM的分层验证和角色感知检索,实现动态企业环境中高效的安全过滤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12177 2025-12-19 cs.SI cs.DL 50%

LitFM: A Retrieval Augmented Structure-aware Foundation Model For Citation Graphs

LitFM:一种基于检索增强的结构感知文献基础模型

Jiasheng Zhang, Jialin Chen, Ali Maatouk, Ngoc Bui, Qianqian Xie, Leandros Tassiulas, Jie Shao, Hua Xu, Rex Ying

专题命中 检索器与排序 :retriever(abstract)

AI总结 LitFM是一种基于检索增强的结构感知文献基础模型,通过整合引用图结构和知识注入的LLM,提升文献检索和相关性评估的准确性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11604 2025-12-16 cs.CR 50%

SoK: Can Fully Homomorphic Encryption Support General AI Computation? A Functional and Cost Analysis

SoK:完全同态加密能否支持通用人工智能计算?功能与成本分析

Jiaqi Xue, Xin Xin, Wei Zhang, Mengxin Zheng, Qianqian Song, Minxuan Zhou, Yushun Dong, Dongjie Wang, Xun Chen, Jiafeng Xie, Liqiang Wang, David Mohaisen, Hongyi Wu, Qian Lou

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 本文探讨FHE能否支持通用AI计算,通过功能和成本分析评估了十种FHE方法,并针对混合线性和非线性操作的工作负载进行了基准测试。

Comments 26th Privacy Enhancing Technologies Symposium (PETS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05428 2025-12-08 cs.SE 50%

Bita: A Conversational Assistant for Fairness Testing

Bita:一个用于公平性测试的对话助手

Keeryn Johnson, Cleyton Magalhaes, Ronnie de Souza Santos

专题命中 检索器与排序 :retrieval-augmented generation(abstract)

AI总结 Bita是一个基于大型语言模型的对话助手,旨在通过公平性视角帮助软件测试人员检测偏见、评估测试计划并生成公平性导向的测试章程,提供可重复的公平性测试解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22609 2025-12-01 cs.CV cs.RO 50%

MG-Nav: Dual-Scale Visual Navigation via Sparse Spatial Memory

MG-Nav:基于稀疏空间记忆的双尺度视觉导航

Bo Wang, Jiehong Lin, Chenzhi Liu, Xinting Hu, Yifei Yu, Tianjia Liu, Zhongrui Wang, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) Southern University of Science and Technology(南方科技大学)

专题命中 检索器与排序 :hybrid retrieval(abstract)

AI总结 MG-Nav通过稀疏空间记忆图和VGGT-adapter模块实现双尺度视觉导航,结合全局规划与局部控制,实现零样本导航的高鲁棒性与高性能。

Comments 10pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05981 2025-11-20 cs.SE 50%

Multi-Agent Debate Strategies to Enhance Requirements Engineering with Large Language Models

Marc Oriol, Quim Motger, Jordi Marco, Xavier Franch

专题命中 检索器与排序 :retrieval augmented generation(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16609 2025-11-18 cs.CE 50%

Aethorix v1.0: An Integrated Scientific AI Agent for Scalable Inorganic Materials Innovation and Industrial Implementation

Yingjie Shi, Yiru Gong, Yiqun Su, Suya Xiong, Jiale Han, Runtian Miao

专题命中 检索器与排序 :knowledge retrieval(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00810 2025-11-18 cs.LG 50%

Scalable Unit Harmonization in Medical Informatics via Bayesian-Optimized Retrieval and Transformer-Based Re-ranking

Jordi de la Torre

机构 * Data Science & Artificial Intelligence, Biopharma R&D(数据科学与人工智能、生物制药研发) AstraZeneca(阿斯利康)

专题命中 检索器与排序 :hybrid retrieval(abstract)

Journal ref International Journal of Medical Informatics 206 (2026) 106180

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11848 2025-11-18 cs.NE 50%

Phase-Coded Memory and Morphological Resonance: A Next-Generation Retrieval-Augmented Generator Architecture

Denis V. Saklakov

专题命中 检索器与排序 :RAG(abstract)

Comments 24 pages, 2 diagrams, conceptual white paper for cognitive AI and memory architecture research. Primary category cs.AI; secondary cs.NE and q-bio.NC

详情

展开后加载摘要…

URL PDF HTML 收藏