arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12659 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12659 篇

2604.22195 2026-04-27 cs.IR 80%

Rethinking Semantic Collaborative Integration: Why Alignment Is Not Enough

重新思考语义协作整合:为什么对齐不够

Maolin Wang, Dongze Wu, Jianing Zhou, Hongyu Chen, Beining Bao, Yu Jiang, Chenbin Zhang, Chang Wang, Jian Liu, Lei Sha

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文挑战了传统语义与协作表示对齐的假设,提出互补融合视角,强调共享与私有因素的区分,通过实验揭示语义与协作视图的低一致性及互补性,倡导以互补性为核心的推荐系统设计。

Comments Accepted by SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14972 2026-04-22 cs.IR 80%

SAGER: Self-Evolving User Policy Skills for Recommendation Agent

SAGER:面向推荐代理的自进化用户策略技能

Zhen Tao, Riwei Lai, Chenyun Yu, Weixin Chen, Li Chen, Beibei Kong, Lei Cheng, Chengxiang Zhuo, Zang Li, Qingqiang Sun

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 SAGER通过为每个用户分配专用策略技能,实现个性化推荐代理的自进化推理,实验表明其在四个公开基准上达到最优性能,证明个性化推理过程是推荐改进的新来源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.03952 2026-04-21 cs.IR 80%

Bridging Language and Items for Retrieval and Recommendation: Benchmarking LLMs as Semantic Encoders

连接语言与物品以实现检索与推荐:评估大语言模型作为语义编码器的基准测试

Yupeng Hou, Jiacheng Li, Xiangjun Fu, Zhankui He, An Yan, Xiusi Chen, Julian McAuley

专题命中 领域大模型 :LLM(summary_cn);large language model(abstract);language model(abstract)

AI总结 本文提出BLaIR基准测试,评估大语言模型在推荐场景中的语义编码能力,通过大规模数据集和多任务评估揭示LLM在推荐任务中的独特挑战。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18142 2026-04-20 cs.HC cs.CY cs.IR 80%

Mirroring Users: Towards Building Preference-aligned User Simulator with User Feedback in Recommendation

镜像用户:构建基于用户反馈的偏好对齐用户模拟器

Tianjun Wei, Huizhong Guo, Yingpeng Du, Zhu Sun, Huang Chen, Dongxia Wang, Jie Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种基于用户反馈的用户模拟器构建框架,通过生成高质量模拟数据提升推荐系统与用户偏好的对齐能力,并通过实验验证其有效性。

Comments ACL 2026 Main. Github: https://github.com/Joinn99/UserMirrorer

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14965 2026-04-17 cs.RO 80%

POMDP-based Object Search with Growing State Space and Hybrid Action Domain

基于增长状态空间和混合动作域的POMDP目标搜索

Yongbo Chen, Hesheng Wang, Shoudong Huang, Hanna Kurniawati

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, 200240, People's Republic of China(自动化与智能感知学院,上海交通大学,上海,200240,中华人民共和国) School of Computing, Australian National University (ANU), Canberra, ACT, 2601, Australia(计算学院,澳大利亚国立大学(ANU),堪培拉,ACT,2601,澳大利亚) Key Laboratory of System Control and Information Processing, Ministry of Education of China, Shanghai, 200240, People's Republic of China(系统控制与信息处理重点实验室,中华人民共和国教育部,上海,200240,中华人民共和国) Robotics Institute, University of Technology Sydney, Australia(机器人研究所,悉尼技术大学,澳大利亚)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出GNPF-kCT算法,通过结合神经过程网络和k中心聚类,解决复杂室内环境中移动机器人高效定位目标物体的问题,实验证明其在目标搜索任务中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11243 2026-04-16 econ.EM 80%

Knowledge Compounding: An Empirical Economic Analysis of Self-Evolving Knowledge Wikis under the Agentic ROI Framework

知识叠加:基于代理ROI框架的自演化知识维基的实证经济分析

Shuide Wen, Beier Ku

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 本文基于代理ROI框架,提出知识叠加概念,并通过实验验证其在LLM代理实证经济学中的有效性,揭示了知识叠加对经济效率的提升机制。

Comments 27 pages, 6 figures, 4 tables, 17 references. Includes empirical data from the Qing Claw open-source multi-agent framework and a 30-day calibrated projection (deterministic seed = 42, fully reproducible). JEL: C63, D24, O33, L86

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06581 2026-04-09 cs.CV 80%

MedGRPO: Multi-Task Reinforcement Learning for Heterogeneous Medical Video Understanding

MedGRPO:异构医学视频理解的多任务强化学习

Yuhao Su, Anwesa Choudhuri, Zhongpai Gao, Benjamin Planche, Van Nguyen Nguyen, Meng Zheng, Yuhan Shen, Arun Innanje, Terrence Chen, Ehsan Elhamifar, Ziyan Wu

机构 * Northeastern University(东北大学) United Imaging Intelligence(联影智能)

专题命中 领域大模型 :LLM(abstract);language model(abstract);SFT(abstract);prompting(abstract)

AI总结 本文提出MedGRPO框架,通过跨数据集奖励归一化和医学LLM评判器提升医学视频理解的训练效果,建立基础基准和训练方法。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03406 2026-04-07 cs.GR 80%

SASAV: Self-Directed Agent for Scientific Analysis and Visualization

SASAV:面向科学分析和可视化的自主代理

Jianxin Sun, David Lenz, Tom Peterka, Hongfeng Yu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出SASAV,首个无需外部提示或人类在环反馈的自主AI代理,可自动执行科学数据分析并生成有洞察力的可视化,推动AI for Science加速大规模科学发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03091 2026-04-06 cs.HC 80%

CASCADE: A Cascading Architecture for Social Coordination with Controllable Emergence at Low Cost

CASCADE:一种用于社交协调的级联架构,具有低成本可控的涌现

Yizhi Xu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 CASCADE通过三级架构实现低成本可控的社会协调,通过宏状态导演、协调枢纽和标签驱动NPC生成多样化但逻辑受限的NPC行为,适用于沙盒游戏世界。

Comments Accepted to CHI 2026 Extended Abstracts

Journal ref Extended Abstracts of the 2026 CHI Conference on Human Factors in Computing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21551 2026-04-01 cs.SE 80%

AI In Cybersecurity Education -- Scalable Agentic CTF Design Principles and Educational Outcomes

AI在网络安全教育中的应用:可扩展的智能体CTF设计原则与教育成效

Haoran Xi, Minghao Shao, Kimberly Milner, Venkata Sai Charan Putrevu, Nanda Rani, Meet Udeshi, Prashanth Krishnamurthy, Brendan Dolan-Gavitt, Siddharth Garg, Sandeep Kumar Shukla, Farshad Khorrami, Alon Hillel-Tuch, Muhammad Shafique, Ramesh Karri

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文研究了基于大语言模型的CTF竞赛设计,探讨了自主性水平和参与者知识背景对问题解决性能和学习行为的影响,提出自主性特定的评分标准和证据要求,以提升网络安全教育的可扩展性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04450 2026-03-31 cs.CR cs.AI cs.CL cs.LG 80%

Learning to Diagnose Privately: DP-Powered LLMs for Radiology Report Classification

在隐私保护下学习:用于放射报告分类的DP驱动LLM

Payel Bhattacharjee, Fengwei Tian, Geoffrey D. Rubin, Joseph Y. Lo, Nirav Merchant, Heidi Hanson, John Gounley, Ravi Tandon

机构 * National Institute of Standards and Technology(美国国家标准与技术研究院) Colorado State University(科罗拉多州立大学) University of Arizona(亚利桑那大学) Duke University(杜克大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种结合差分隐私与LoRA的隐私保护LLM微调框架,用于多异常放射报告分类,通过生成标签训练小型模型,在强隐私保障下实现高效推理。

Comments Accepted in IEEE ACCESS, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15840 2026-03-18 cs.LG cs.AI cs.CL stat.ML 80%

When Stability Fails: Hidden Failure Modes Of LLMS in Data-Constrained Scientific Decision-Making

当稳定性失效:在数据受限的科学决策中LLM的隐藏故障模式

Nazia Riasat

机构 * North Dakota State University(北达科他州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示LLM在数据受限科学决策中稳定性不足的问题,通过控制评估框架发现其在正确性、提示敏感性和输出有效性方面的缺陷。

Comments 13 pages, 5 figures. Accepted at ICLR 2026 Workshop: I Can't Believe It's Not Better (ICBINB 2026). OpenReview: https://openreview.net/pdf?id=vf8vs2ibso

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05751 2026-03-09 cs.RO cs.HC 80%

Vision-Language System using Open-Source LLMs for Gestures in Medical Interpreter Robots

基于开源大语言模型的医疗解释机器人手势视觉语言系统

Thanh-Tung Ngo, Emma Murphy, Robert J. Ross

机构 * Technological University Dublin(都柏林技术大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出一种基于开源大语言模型的医疗机器人系统,通过检测言语行为并生成相应手势,提升跨语言沟通效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00310 2026-02-13 cs.LG cs.AI cs.CL 80%

AutoDiscovery: Open-ended Scientific Discovery via Bayesian Surprise

AutoDiscovery: 通过贝叶斯惊喜实现开放性科学发现

Dhruv Agarwal, Bodhisattwa Prasad Majumder, Reece Adamson, Megha Chakravorty, Satvika Reddy Gavireddy, Aditya Parashar, Harshit Surana, Bhavana Dalvi Mishra, Andrew McCallum, Ashish Sabharwal, Peter Clark

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Allen Institute for AI(人工智能研究院) Capital One

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AutoDiscovery通过贝叶斯惊喜驱动科学探索,实现开放性科学发现,显著提升发现数量和质量。

Comments Accepted to NeurIPS 2025: https://neurips.cc/virtual/2025/loc/san-diego/poster/116398

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10411 2026-02-12 cs.IR 80%

GeoGR: A Generative Retrieval Framework for Spatio-Temporal Aware POI Recommendation

GeoGR: 一种面向空间时间感知的POI推荐生成框架

Fangye Wang, Haowen Lin, Yifang Yuan, Siyuan Wang, Xiaojiang Zhou, Song Yang, Pengjie Wang

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 GeoGR是一种面向空间时间感知的POI推荐生成框架,通过两阶段设计提升POI推荐的准确性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11559 2026-01-21 cs.AI cs.CL cs.LG 80%

MIMIC-RD: Can LLMs differentially diagnose rare diseases in real-world clinical settings?

MIMIC-RD: 能否在真实临床环境中让大语言模型对罕见病进行差异性诊断?

Zilal Eiz AlDin, John Wu, Jeffrey Paul Fung, Jennifer King, Mya Watts, Lauren ONeill, Adam Richard Cross, Jimeng Sun

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Illinois College of Medicine(伊利诺伊大学医学学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MIMIC-RD通过直接映射临床文本实体到Orphanet,评估LLM在真实临床环境下的罕见病差异性诊断能力,发现现有模型表现不佳,揭示了临床需求与现有能力之间的差距。

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09858 2026-01-16 cs.CL cs.AI cs.LG 80%

OUTLINEFORGE: Hierarchical Reinforcement Learning with Explicit States for Scientific Writing

OUTLINEFORGE: 基于显式状态的分层强化学习用于科学写作

Yilin Bao, Ziyao He, Zayden Yang

机构 * UC San Diego(圣迭戈大学) Ohio State University(俄亥俄州立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 OUTLINEFORGE通过分层强化学习和显式状态管理,提升科学写作的全局结构和引用一致性,改进文档规划和事实准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09727 2026-01-16 cs.CL cs.AI cs.IR cs.LG 80%

SciNets: Graph-Constrained Multi-Hop Reasoning for Scientific Literature Synthesis

SciNets: 图约束多跳推理用于科学文献综合

Sauhard Dubey

机构 * Jaypee Institute of Information Technology(杰伊佩 Institute 信息科技学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 SciNets通过图约束多跳推理实现科学文献综合,通过多跳路径连接罕见共现的概念,提升机制解释的稳定性和多样性。

Comments 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09398 2026-01-15 cs.CL cs.AI cs.LG 80%

Ability Transfer and Recovery via Modularized Parameters Localization

通过模块化参数定位实现能力迁移与恢复

Songyao Jin, Kun Zhou, Wenqi Li, Peng Wang, Biwei Huang

机构 * University of California San Diego(加州大学圣地亚哥分校)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 ACT通过激活差异局部化能力相关通道,实现能力迁移与恢复,提升多语言数学和科学推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13238 2025-12-05 cs.LG cs.AI cs.CL cs.CY 80%

Computational Measurement of Political Positions: A Review of Text-Based Ideal Point Estimation Algorithms

政治立场的计算测量:基于文本的理想点估计算法综述

Patrick Parschan, Charlott Jakob

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文综述了基于文本的理想点估计算法,分析了四种方法家族的优缺点,为应用研究提供指导。

Comments 46 pages, 8 figures, 2 tables, accepted for publication in Quality & Quantity

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00887 2025-12-04 cs.CV 80%

Multilingual Training-Free Remote Sensing Image Captioning

多语言免训练 遥感图像描述生成

Carlos Rebelo, Gil Rocha, João Daniel Silva, Bruno Martins

机构 * INESC-ID(葡萄牙里斯本INESC-ID研究所) Instituto Superior Técnico(葡萄牙里斯本技术大学) Faculdade de Engenharia da Universidade do Porto(葡萄牙波尔图大学工程学院)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出一种无需训练的多语言遥感图像描述生成方法,通过检索增强提示和图基重新排序策略,实现跨语言的高效描述生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04737 2025-11-18 cs.CL cs.AI cs.IR cs.LG 80%

TathyaNyaya and FactLegalLlama: Advancing Factual Judgment Prediction and Explanation in the Indian Legal Context

Shubham Kumar Nigam, Balaramamahanthi Deepak Patnaik, Shivam Mishra, Noel Shallum, Kripabandhu Ghosh, Arnab Bhattacharya

机构 * Indian Institute of Technology Kanpur(印度理工学院坎浦尔分校) Symbiosis Law School Pune(辛博斯法学院浦那) IISER Kolkata(印度科学研究所科希利) University of Birmingham(伯明翰大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Paper accepted in the AACL-IJCNLP 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00916 2025-11-04 cs.CV 80%

Fleming-VL: Towards Universal Medical Visual Reasoning with Multimodal LLMs

Yan Shu, Chi Liu, Robin Chen, Derek Li, Bryan Dai

机构 * Ubiquant(乌比量化)

专题命中 领域大模型 :large language model(abstract);language model(abstract);pretraining(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12371 2025-10-31 cs.AI cs.CL cs.LG cs.MA 80%

MedAgentBoard: Benchmarking Multi-Agent Collaboration with Conventional Methods for Diverse Medical Tasks

Yinghao Zhu, Ziyi He, Haoran Hu, Xiaochen Zheng, Xichen Zhang, Zixiang Wang, Junyi Gao, Liantao Ma, Lequan Yu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by NeurIPS 2025 Datasets & Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23626 2025-10-29 cs.LG cs.AI cs.CL 80%

From Detection to Discovery: A Closed-Loop Approach for Simultaneous and Continuous Medical Knowledge Expansion and Depression Detection on Social Media

Shuang Geng, Wenli Zhang, Jiaheng Xie, Rui Wang, Sudha Ram

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Presented at SWAIB2025 and HICSS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04444 2025-10-29 cs.DL 80%

Data Discovery using LLMs -- A Study of Data User Behaviour

Christin Katharina Kreutz, Anja Perry, Tanja Friedrich

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted as full paper at TPDL'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23189 2025-10-28 cs.CL cs.AI cs.LG 80%

DREaM: Drug-Drug Relation Extraction via Transfer Learning Method

Ali Fata, Hossein Rahmani, Parinaz Soltanzadeh, Amirhossein Derakhshan, Behrouz Minaei Bidgoli

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05201 2025-10-27 cs.LG cs.AI cs.CL 80%

FAITH: A Framework for Assessing Intrinsic Tabular Hallucinations in Finance

Mengao Zhang, Jiayu Fu, Tanya Warrier, Yuwen Wang, Tianhui Tan, Ke-wei Huang

机构 * Asian Institute of Digital Finance, National University of Singapore(亚洲数字金融研究所,新加坡国立大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 9 pages, AMC ICAIF'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02992 2025-10-27 cs.AI cs.CL cs.LG 80%

Mitigating Manipulation and Enhancing Persuasion: A Reflective Multi-Agent Approach for Legal Argument Generation

Li Zhang, Kevin D. Ashley

机构 * Intelligent Systems Program University of Pittsburgh Pittsburgh Pennsylvania USA Intelligent Systems Program University of Pittsburgh

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, 2 figures, 2nd ConventicLe on Artificial Intelligence Regulation and Safety Workshop at ICAIL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09557 2025-10-14 cs.IR 80%

Doc2Query++: Topic-Coverage based Document Expansion and its Application to Dense Retrieval via Dual-Index Fusion

Tzu-Lin Kuo, Wei-Ning Chiu, Wei-Yun Ma, Pu-Jen Cheng

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏