arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12659 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12659 篇

2606.30921 2026-07-01 cs.DC 新提交 80%

Towards Transparent Checkpointing with AI-driven Code Generation

迈向基于AI驱动代码生成的透明检查点

Hai Duc Nguyen, Tekin Bicer, Kyle Chard, Ian Foster, Bogdan Nicolae

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究使用大型语言模型自动为MPI科学应用生成检查点/重启代码,平均50分钟完成,开销可忽略,恢复效率与人工实现相当。

Journal ref FlexScience'26: The 2026 Workshop on AI and Scientific Computing at Scale using Flexible Computing Infrastructures (in conjunction with HPDC'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16532 2026-07-01 cs.IR 版本更新 80%

Causal-Invariant Cross-Domain Out-of-Distribution Recommendation

因果不变的跨域分布外推荐

Jiajie Zhu, Yan Wang, Feng Zhu, Pengfei Ding, Hongyang Liu, Zhu Sun

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出CICDOR框架,通过双层级因果结构推断域特定和域共享的因果不变用户偏好,并利用LLM发现混杂因子,解决跨域和单域分布偏移导致的分布外问题,提升推荐准确性。

Comments Corrected author affiliation. Accepted by ACM TOIS for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26573 2026-06-26 cs.CY cs.HC 新提交 80%

Pingquanqi (Equalizer): A Cross-Domain Sociotechnical Framework for Human-Agent Interaction Governance

Pingquanqi(均衡器):人机交互治理的跨领域社会技术框架

Yu Wang

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出Pingquanqi框架,通过用户状态区分、贝叶斯止损、可控摩擦和透明度度量等组件,优化LLM代理交互成本,保护用户时间资源,兼顾企业经济效益。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03724 2026-06-26 cs.IR 版本更新 80%

Rank, Don't Generate: Statement-level Ranking for Explainable Recommendation

排序,而非生成:面向可解释推荐的语句级排序

Ben Kabongo, Arthur Satouf, Vincent Guigue

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出将可解释推荐形式化为语句级排序问题,通过从评论中提取解释性语句并排序,避免生成式幻觉,支持细粒度事实分析和标准化评估。

Comments 12 pages, 7 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25398 2026-06-25 cs.RO 新提交 80%

MAPL: Multi-Objective Preference Learning for Robot Locomotion

MAPL:机器人运动的多目标偏好学习

Xiyue Chen, Muhan Lin, Shuyang Shi, Joseph Campbell

机构 * Purdue University(普渡大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出MAPL框架,利用大语言模型从自然语言目标中学习多目标偏好,替代手工奖励函数,在四足机器人运动任务中达到或超越专家设计奖励的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22803 2026-06-24 cs.IR 新提交 80%

Towards Fast Domain Adaptation and Fine-Grained User Simulation for Evaluating Conversational Recommender Systems

面向快速领域自适应和细粒度用户模拟的对话推荐系统评估

Yuanzi Li, Quanyu Dai, Xueyang Feng, Zihang Tian, Junhao Wang, Xu Chen, Zhenhua Dong, Huifeng Guo

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出AdaptSim框架,通过自动提示生成和开放动作机制实现快速领域自适应,采用“思考-响应”策略控制语言风格,并基于广度优先搜索的逐轮对比评估对话推荐系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21389 2026-06-23 cs.CR 新提交 80%

From Production SIEM to Reusable Cybersecurity Artifacts

从生产SIEM到可复用的网络安全工件

Sidnei Barbieri, Leonardo Vaz de Meneses, Ágney Lopes Roth Ferraz, Wagner Comin Sonaglio, Lourenço Alves Pereira Júnior

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一种从生产金融安全运营中心提取、匿名化、结构化并验证SIEM数据的方法,生成可复用的研究工件,并通过训练和测量实验验证其隐私-效用边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17179 2026-06-16 cs.MA 版本更新 80%

Ablation Study of a Fairness Auditing Agentic System for Bias Mitigation in Early-Onset Colorectal Cancer Detection

公平性审计代理系统在早发性结直肠癌检测中缓解偏见的消融研究

Amalia Ionescu, Jose Guadalupe Hernandez, Jui-Hsuan Chang, Emily F. Wong, Paul Wang, Jason H. Moore, Tiffani J. Bright

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出双代理架构(领域专家代理+公平性顾问代理),通过消融实验比较不同配置下大语言模型在公平性审计中的表现,发现带RAG的代理系统在识别差异方面语义相似度最高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09290 2026-06-10 cs.SE cs.CE cs.MA 版本更新 80%

ToolRosella: Translating Code Repositories into Standardized Tools for Scientific Agents

ToolRosella: 将代码仓库翻译为科学智能体的标准化工具

Shimin Di, Xujie Yuan, Hanghui Guo, Chaoqian Ouyang, Yongxu Liu, Ling Yue, Zhangze Chen, Libin Zheng, Jia Zhu, Shaowu Pan, Jian Yin, Yong Rui, Min-Ling Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出ToolRosella框架,通过仓库分析、工具接口构建、执行测试和迭代修复,自动将异构科学代码仓库转化为标准化、可被智能体调用的工具,在122个仓库上达到61.5%的转换成功率,下游任务成功率为84.0%。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03852 2026-06-10 physics.geo-ph 版本更新 80%

Advancing Subsurface Discovery and Geothermal Monitoring with an Agentic Artificial Intelligence Framework

基于智能体人工智能框架推进地下发现与地热监测

Randy Harsuko, Zhengfa Bi, Guodong Chen, Nori Nakata

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出GAIA系统,结合大语言模型、数字孪生与检索增强生成,实现地热开发中的多学科任务自动化与智能决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09637 2026-06-09 cs.SE 新提交 80%

Agentic Persona Generation with Critique-Refinement: An Industrial Evaluation

基于批评-改进的智能体角色生成:工业评估

Mohammad Hossein Amini, David Dewar, Shiva Nejati, Mehrdad Sabetzadeh

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出PerGent方法,通过迭代批评-改进循环利用LLM智能体生成角色,在工业部署中专家认可率达96.9%,优于单次生成方法。

Comments Accepted in the Industry Track of the Requirements Engineering (RE) 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06749 2026-06-08 q-bio.QM 新提交 80%

Deterministic access to global viral sequence data enables robust agentic scientific discovery

确定性访问全球病毒序列数据实现稳健的自主科学发现

Ferdous Nasri, Sarah Gurev, Patrick Varilly, Krithik Ramesh, Nuala A. O'Leary, Jonah Cool, Bernhard Y. Renard, Pardis C. Sabeti, Laura Luebbert

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对基于大语言模型的科学代理在病毒数据检索中的高错误率问题,提出确定性查询框架gget virus,通过形式化NCBI Virus过滤流程、元数据约束和结构化记录检索,将检索准确率提升至90%以上,并减少98%数据传输。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17601 2026-06-08 cs.IR cs.SI 80%

Why They Link: An Intent Taxonomy for Including Hyperlinks in Social Posts

为何他们链接:一种包含超链接在社交帖子中的意图分类

Fangping Lan, Abdullah Aljebreen, Eduard C. Dragut

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种意图分类,通过混合方法分析用户对超链接的感知意图,揭示广告、论证和分享是最常见的意图,并在微博客检索任务中展示其应用价值。

Comments 10 pages including references, 5 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24481 2026-06-05 cs.CV 80%

OmniEgo-R$^2$: A Routed Reasoning Framework for the 1st Cross-Domain EgoCross Challenge at CVPR 2026

OmniEgo-R$^2$:面向CVPR 2026首届跨领域EgoCross挑战赛的路由推理框架

Zixu Li, Zhiwei Chen, Zhiheng Fu, Wenbo Wang, Yupeng Hu, Weili Guan, Liqiang Nie

机构 * Shandong University(山东大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 领域大模型 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对跨领域自我中心视频推理中的时间边界模糊、语义粒度不匹配和决策不稳定问题,提出OmniEgo-R$^2$路由推理框架,在Source-Limited和Open-Source赛道均获第二名。

Comments Technical Report for the 1st Cross-Domain EgoCross Challenge at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25970 2026-06-05 cs.CV 80%

PathWISE: Multi-Agent Cancer Pathway Triaging Ontology Learning from Clinical Flowcharts

PathWISE: 基于临床流程图的多智能体癌症路径分诊本体学习

Sofiat Abioye, Ufaq Khan, Shazad Ashraf, Mohammed Adil Butt, Andrew D. Beggs, Adam Byfield, Anusha Jose, Junaid Qadir, Muhammad Bilal

机构 * Birmingham City University(伯明翰城市大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) University Hospitals Birmingham NHS Foundation Trust(伯明翰大学医院国家健康服务信托基金) NHS England (National Health Service)(英格兰国家健康服务局) Qatar University(卡塔尔大学)

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出PathWISE五阶段流水线,结合四个基于LLM的智能体、确定性深度优先搜索审计器和Java编译器批评者,将临床流程图转化为可执行的HL7 CQL库,覆盖100%患者路径,并在五种NHS癌症路径上验证。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03416 2026-06-03 cs.MA 80%

MeDxAgent: Multi-Agent Consultation for Interactive Medical Diagnosis

MeDxAgent: 交互式医疗诊断的多智能体咨询系统

Akshat Sanghvi, Naren Akash, Raza Imam, Amit Sharma, Mohit Jain

专题命中 领域大模型 :LLM(summary_cn);large language model(abstract);language model(abstract)

AI总结 针对现有LLM诊断评估与临床实践脱节的问题,提出多智能体咨询系统MeDxAgent和基准MeDxBench,通过交互式诊断流程将准确率提升10.3%。

Comments 28 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00042 2026-06-02 cs.CY cs.ET 80%

TransResAI: A Compound AI System for Coastal Transportation Resilience

TransResAI: 用于沿海交通韧性的复合AI系统

Qingwen Pu, Kun Xie, Chenyu Yan

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出TransResAI复合AI系统,通过自然语言交互集成大语言模型与多模块,实现洪水感知的交通韧性分析,在专家用户研究中将任务完成时间减少80-88%,准确率保持4.60/5.00。

Comments 36 pages, 13 figures, 3 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28334 2026-06-02 cs.CR 80%

Towards Cybersecurity SuperIntelligence (CSI): What's the best harness for cybersecurity?

迈向网络安全超级智能(CSI):什么是网络安全的最佳驾驭方式?

Víctor Mayoral-Vilches, Francesco Balassone, María Sanz-Gómez, Paul Zabalegui Landa, Daniel Sánchez Prieto, Marina Oteiza Álvarez, Davide Quarta, Martin Pinzger

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一种元脚手架(meta-scaffold)统一异构智能体框架,通过黑板架构实现多框架并行协作,在33个cybench挑战中覆盖率达57.6%,相比最佳单一框架提升27%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21772 2026-06-02 cs.CR 80%

PhishLumos: An Adaptive Multi-Agent System for Proactive Phishing Campaign Mitigation

PhishLumos:一种用于主动缓解钓鱼攻击活动的自适应多智能体系统

Daiki Chiba, Hiroki Nakano, Takashi Koide

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出PhishLumos自适应多智能体系统,利用大语言模型智能体分析共享基础设施,在专家确认前一周主动识别钓鱼活动,实现从被动URL拦截到主动活动缓解的转变。

Comments Originally presented at IEEE ICC 2026. An extended version of this work has been published in IEEE Access: https://doi.org/10.1109/ACCESS.2026.3696597

Journal ref D. Chiba, H. Nakano, and T. Koide, "PhishLumos: From a Single URL to Campaign-Level Phishing Mitigation," IEEE Access, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29744 2026-05-29 cs.AI cs.CL cs.LG cs.MA 80%

Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Artificial Intelligence

为什么专家模型仍然重要:面向医学人工智能的异构多智能体范式

Yanan Wang, Shuaicong Hu, Jian Liu, Guohui Zhou, Aiguo Wang, Cuiwei Yang

机构 * Fudan University(复旦大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出HetMedAgent异构多智能体框架,通过冲突感知证据融合、不确定性驱动的临床医生干预触发和自适应阈值校准,实现通用大语言模型与领域专家模型的协同,在三个临床决策任务中验证了专家模型在模态特定分析中的不可替代价值。

Comments Accepted at ICML 2026. 12 pages main text, 16 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26533 2026-05-27 cs.CV cs.AI cs.CL cs.LG 80%

A Hybrid Vision-Language Architecture for Automated Defect Reasoning and Report Generation in Industrial Inspection

一种用于工业检测中自动缺陷推理与报告生成的混合视觉-语言架构

Malikussaid, Imad Gohar

机构 * School of Computing, Telkom University(Telkom大学计算机学院) Faculty of Engineering and Technology, School of Computing and Artificial Intelligence(工程与技术学院,计算与人工智能学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种解耦的边缘可部署管道,结合YOLO26-x-obb检测器、确定性编码模块和QLoRA微调的Qwen-2.5-1.5B模型,实现风电叶片缺陷定位与结构化报告生成,在BLEU-4、幻觉率和专家评分上显著优于零样本VLM基线。

Comments 23 pages, 6 figures, 9 equations, and 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00944 2026-05-27 cs.CY 80%

Auditing the Reliability of Multimodal Generative Search

审计多模态生成式搜索的可靠性

Erfan Samieyan Sahneh, Luca Maria Aiello

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 通过大规模审计Gemini 2.5 Pro系统,发现3.7%至18.7%的基于视频的生成式搜索声明未被引用来源支持,主要失败模式为不可验证的特异性与夸大声明。

Comments 14 pages, LaTeX, typos corrected, adding Data Availability section + examples in appendix, New plot(overview)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24397 2026-05-26 cs.SE 80%

Breaking Changes in Software Ecosystems: A Systematic Literature Review

软件生态系统中的破坏性变更:系统文献综述

Juntao Chen, Tingting Bi, Yanlin Wang, Patanamon Thongtanunam

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 本文通过系统文献综述,对软件生态系统中破坏性变更的类别、原因、检测方法和应对策略进行了全面综合,并指出了行为变更检测、语义版本控制失效和传递依赖传播等挑战,以及LLM增强行为契约推断等研究机会。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19901 2026-05-20 cs.SE 80%

Can LLMs Produce Better Object-Oriented Designs than Human-Involved Development?

LLMs能否产生比人类参与开发更好的面向对象设计?

Zushuai Zhang, Elliott Wen, Ewan Tempero

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文研究了LLMs在生成面向对象设计(OOD)项目时的表现,通过比较预AI、后AI和纯AI三种作者条件下的项目质量,发现纯AI项目在代码异味密度和整体复杂度上较低,但存在过度简化的问题,结论指出在使用LLMs进行面向对象设计时,适当的人类指导仍很重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04083 2026-05-19 cs.HC cs.GR 80%

VOICE: Visual Oracle for Interaction, Conversation, and Explanation

VOICE:交互、对话和解释的视觉 oracle

Donggang Jia, Alexandra Irger, Lonni Besancon, Ondrej Strnad, Deng Luo, Johanna Bjorklund, Anders Ynnerman, Ivan Viola

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出VOICE,一种将大语言模型的对话能力与交互式探索可视化相结合的科学传播新方法,通过多机器人系统实现任务分配、指令提取和内容生成,结合文本到可视化方法和自然语言交互,实现实时3D模型导航和操控,并在分子可视化领域验证其有效性。

Journal ref IEEE Transactions on Visualization and Computer Graphics 31(10):8828-8845, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15729 2026-05-18 cs.NE 80%

General-Purpose Co-Evolutionary Construction of Parallel Algorithm Portfolios for Multi-Objective Binary Optimization

通用目的协同进化并行算法组合在多目标二进制优化中的构建

Zhiyuan Wang, Shengcai Liu, Shaofeng Zhang, Ke Tang

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 本文提出DACMO方法,通过神经实例表示架构和LLM自动搜索算子生成,解决多目标二进制优化问题中的通用并行算法组合构建问题,实验显示其在四个问题类上均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06673 2026-05-11 cs.CL cs.AI cs.LG 80%

Domain-level metacognitive monitoring in frontier LLMs: A 33-model atlas

领域级元认知监控在前沿大语言模型中的应用:一个33模型图谱

Jon-Paul Cacioli

机构 * Independent Researcher(独立研究员)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过33个前沿LLM在MMLU基准领域中的表现,揭示了元认知评分掩盖的领域级差异,发现应用/专业知识领域监控效果最佳,而形式推理和自然科学领域最难,且中等难度领域无显著差异。

Comments 25 pages, 7 figures, 1 supplementary table. Code and data: https://github.com/synthiumjp/metacognitive-profile-atlas

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11459 2026-04-30 cs.CR 80%

ProxyPrompt: Securing System Prompts against Prompt Extraction Attacks

ProxyPrompt:抵御提示提取攻击的系统提示安全机制

Zhixiong Zhuang, Maria-Irina Nicolae, Hui-Po Wang, Mario Fritz

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出ProxyPrompt,通过替换原始提示以防止提示泄露,有效保护94.70%的提示免受提取攻击,优于现有防御方法。

Comments Accepted as Findings of ACL 2026.Code: https://github.com/boschresearch/proxyprompt

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24048 2026-04-28 cs.IR 80%

Disagreement as Signals: Dual-view Calibration for Sequential Recommendation Denoising

分歧作为信号:用于顺序推荐去噪的双视角校准

Sijia Li, Min Gao, Zongwei Wang, Zhiyi Liu, Xin Xia, Yi Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出DC4SR框架,通过双视角校准提升顺序推荐的去噪效果,结合语义先验和模型后验分布,增强对用户兴趣演变的适应性。

Comments 9 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23982 2026-04-28 cs.CV 80%

Hierarchical Prototype-based Domain Priors for Multiple Instance Learning in Multimodal Histopathology Analysis

层次化原型域先验用于多实例学习的多模态病理分析

Xuemei Qiu, Dawei Fan, Yebin Huang, Yanping Chen, Lifang Wei

机构 * College of Computer and Information Science, Fujian Agriculture and Forestry University(福建农林大学计算机与信息科学学院) College of Future Technology, Fujian Agriculture and Forestry University(福建农林大学未来技术学院) Digital Fujian Institute of Agricultural Big Data, Fujian Agriculture and Forestry University(福建农业大数据数字福建研究院) Department of Pathology, Clinical Oncology School of Fujian Medical University, and Fujian Cancer Hospital(福建医科大学临床肿瘤学院病理科及福建癌症医院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出HPDP框架,通过引入形态锚定原型系统和正弦位置编码,解决多实例学习中数据驱动黑箱问题,提升病理诊断与预后分析的鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏