arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-28 至 2025-10-28 共收录 412 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 28 篇

2510.22878 2025-10-28 cs.LG 57%

Limits of Generative Pre-Training in Structured EMR Trajectories with Irregular Sampling

Nicholas I-Hsien Kuo, Blanca Gallego, Louisa Jorm

机构 * Centre for Big Data Research in Health, Faculty of Medicine, University of New South Wales, Sydney, NSW, Australia(健康大数据研究中心,医学院,新南威尔士大学,悉尼,新南威尔士州,澳大利亚)

专题命中 领域大模型 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17047 2025-10-28 cs.CL 57%

Modeling Bottom-up Information Quality during Language Processing

Cui Ding, Yanning Yin, Lena A. Jäger, Ethan Gotlieb Wilcox

专题命中 领域大模型 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11093 2025-10-28 cs.CL 57%

RAEmoLLM: Retrieval Augmented LLMs for Cross-Domain Misinformation Detection Using In-Context Learning Based on Emotional Information

Zhiwei Liu, Kailai Yang, Qianqian Xie, Christine de Kock, Sophia Ananiadou, Eduard Hovy

机构 * The University of Manchester(曼彻斯特大学) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) The University of Melbourne(墨尔本大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL

Comments Accepted by ACL 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23339 2025-10-28 astro-ph.IM 50%

The Programmable Liquid-crystal Active Coronagraphic Imager for the 4-m DAG telescope (PLACID) instrument: installation and commissioning update

Jonas G. Kühn, Ruben Tandon, Lucas Marquis, Liurong Lin, Derya Öztürk Çetni, Iljadin Manurung, Axel Potier, Laurent Jolissaint, Audrey Baur, Daniele Piazza, Mathias Brändli, Martin Rieder

专题命中 领域大模型 :SLM(abstract)

Comments 10 pages, 9 figures, SPIE Optics + Photonics: Techniques and Instrumentation for Detection of Exoplanets XII (San Diego 2025), Paper 136270Z. arXiv admin note: substantial text overlap with arXiv:2408.10893

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22803 2025-10-28 cs.CV 50%

MedXplain-VQA: Multi-Component Explainable Medical Visual Question Answering

Hai-Dang Nguyen, Minh-Anh Dang, Minh-Tan Le, Minh-Tuan Le

机构 * Faculty Of Information Technology VNU University of Engineering(信息科技学院越南工程大学) IT-BT Convergence Technology Division Vietnam-Korea Institute of Science(IT-BT融合技术部门越南-韩国科学技术院) TADI Global Lab TADI Global Company Limited(TADI全球实验室TADI全球有限公司) Faculty of Finance Banking Academy of Vietnam(金融学院越南银行学院)

专题命中 领域大模型 :language model(abstract)

Comments 10 pages, 4 figures, IEEE conference format

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22530 2025-10-28 cs.SE 50%

Finding the Needle in the Crash Stack: Industrial-Scale Crash Root Cause Localization with AutoCrashFL

Sungmin Kang, Sumi Yun, Jingun Hong, Shin Yoo, Gabin An

专题命中 领域大模型 :LLM(abstract)

Comments 11 pages, 8 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06714 2025-10-28 cs.IR 50%

Unifying Search and Recommendation with Dual-View Representation Learning in a Generative Paradigm

Jujia Zhao, Wenjie Wang, Chen Xu, Xiuying Chen, Zhaochun Ren, Suzan Verberne

专题命中 领域大模型 :instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00949 2025-10-28 cs.CV 50%

Harnessing The Power of Attention For Patch-Based Biomedical Image Classification

Gousia Habib, Shaima Qureshi, Malik ishfaq

专题命中 领域大模型 :post-training(abstract)

Journal ref 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 14 篇

2510.07290 2025-10-28 cs.CL cs.LG 88%

On the Convergence of Moral Self-Correction in Large Language Models

Guangliang Liu, Haitao Mao, Bochuan Cao, Zhiyu Xue, Xitong Zhang, Rongrong Wang, Kristen Marie Johnson

机构 * Michigan State University(密歇根州立大学) Amazon(亚马逊) Pennsylvania State University(宾夕法尼亚州立大学) University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15702 2025-10-28 cs.CL 88%

LyapLock: Bounded Knowledge Preservation in Sequential Large Language Model Editing

Peng Wang, Biyu Zhou, Xuehai Tang, Jizhong Han, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22892 2025-10-28 cs.RO cs.SY eess.SY 85%

Never Too Rigid to Reach: Adaptive Virtual Model Control with LLM- and Lyapunov-Based Reinforcement Learning

Jingzehua Xu, Yangyang Li, Yangfei Chen, Guanwen Xie, Shuai Zhang

机构 * Department of Engineering, University of Cambridge(剑桥大学工程系) Department of Electrical Engineering and Computer Science, Massachusetts Institute of Technology(麻省理工学院电气工程与计算机科学系) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学-伊利诺伊大学厄巴纳-香槟分校联合研究所) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际 Graduate School) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23184 2025-10-28 cs.CV 82%

Finding 3D Scene Analogies with Multimodal Foundation Models

Junho Kim, Young Min Kim

机构 * Institute of New Media and Communications(新媒体与通讯研究所) Dept. of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract)

Comments Accepted to FM4RoboPlan workshop at RSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19207 2025-10-28 cs.CL cs.AI 81%

FaithUn: Toward Faithful Forgetting in Language Models by Investigating the Interconnectedness of Knowledge

Nakyeong Yang, Minsung Kim, Seunghyun Yoon, Joongbo Shin, Kyomin Jung

机构 * Seoul National University(首尔国立大学) Adobe Research(Adobe研究) LG AI Research(LG人工智能研究)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22127 2025-10-28 cs.CV cs.LG 79%

Mint: A Simple Test-Time Adaptation of Vision-Language Models against Common Corruptions

Wenxuan Bao, Ruxi Deng, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19911 2025-10-28 cs.CV 78%

Attention! Your Vision Language Model Could Be Maliciously Manipulated

Xiaosen Wang, Shaokang Wang, Zhijin Ge, Yuyang Luo, Shudong Zhang

专题命中 知识编辑与模型理解 :language model(title,abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21965 2025-10-28 cs.MA 78%

LLM-augmented empirical game theoretic simulation for social-ecological systems

Jennifer Shi, Christopher K. Frantz, Christian Kimmich, Saba Siddiki, Atrisha Sarkar

专题命中 知识编辑与模型理解 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22866 2025-10-28 cs.CL cs.LG 73%

Interpreting and Mitigating Unwanted Uncertainty in LLMs

Tiasa Singha Roy, Ayush Rajesh Jhaveri, Ilias Triantafyllopoulos

机构 * New York University(纽约大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22139 2025-10-28 cs.LG cs.CL 73%

Edit Less, Achieve More: Dynamic Sparse Neuron Masking for Lifelong Knowledge Editing in LLMs

Jinzhe Liu, Junshu Sun, Shufan Shen, Chenxue Yang, Shuhui Wang

机构 * Key Lab of Intell. Info. Process., Inst. of Comput. Tech., CAS(智能信息处理重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Agriculture Information Institute, CAAS(农业信息研究所,中国农业科学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 19 pages, 11 figures, Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21059 2025-10-28 cs.CL 70%

Dynamic Retriever for In-Context Knowledge Editing via Policy Optimization

Mahmud Wasif Nafee, Maiqi Jiang, Haipeng Chen, Yanfu Zhang

机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院) Bangladesh University of Engineering and Technology(孟加拉工程与技术大学) College of William & Mary(威廉与玛丽学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at EMNLP 2025. Copyright 2025 Association for Computational Linguistics (CC BY 4.0). 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17394 2025-10-28 cs.CV cs.AI 70%

HiProbe-VAD: Video Anomaly Detection via Hidden States Probing in Tuning-Free Multimodal LLMs

Zhaolin Cai, Fan Li, Ziwei Zheng, Yanjun Qin

机构 * Xinjiang University(新疆大学) Xi'an Jiaotong University(西安交通大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22322 2025-10-28 cs.CV 50%

Beyond Augmentation: Leveraging Inter-Instance Relation in Self-Supervised Representation Learning

Ali Javidani, Babak Nadjar Araabi, Mohammad Amin Sadeghi

机构 * School of Electrical and Computer Engineering, College of Engineering, University of Tehran(埃塞电气与计算机工程学院,工程学院,德黑兰大学) Qatar Computing Research Institute, Hamad bin Khalifa University(卡塔尔计算研究所,哈马德·本·卡伊夫大学)

专题命中 知识编辑与模型理解 :pretraining(abstract)

Comments Accepted in IEEE Signal Processing Letters, 2025

Journal ref IEEE Signal Processing Letters, vol. 32, pp. 3730-3734, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10097 2025-10-28 cs.CV 50%

Gesplat: Robust Pose-Free 3D Reconstruction via Geometry-Guided Gaussian Splatting

Jiahui Lu, Haihong Xiao, Xueyan Zhao, Wenxiong Kang

专题命中 知识编辑与模型理解 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他LLM 30 篇

2510.21958 2025-10-28 cs.CL cs.DL 88%

A Stylometric Application of Large Language Models

Harrison F. Stropkay, Jiayi Chen, Mohammad J. Latifi, Daniel N. Rockmore, Jeremy R. Manning

机构 * Dartmouth College(达特茅斯学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL;LLM(comments)

Comments All code and data needed to reproduce the results in this paper are available at https://github.com/ContextLab/llm-stylometry

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21723 2025-10-28 cs.HC 88%

Recognizing internal states in AI: evidence from patterned preferences in large language models

Annika Hedberg

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

Comments 14 pages, 1 table. Includes test protocol transcript and multi-system response data

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22219 2025-10-28 cs.CL cs.AI math.PR 87%

Estimating the Error of Large Language Models at Pairwise Text Comparison

Tianyi Li

机构 * Department of Decisions, Operations and Technology, CUHK(决策、运营与技术系,香港中文大学)

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22422 2025-10-28 cs.MA cs.AI cs.CY physics.soc-ph 85%

Group size effects and collective misalignment in LLM multi-agent systems

Ariel Flint, Luca Maria Aiello, Romualdo Pastor-Satorras, Andrea Baronchelli

机构 * Department of Mathematics, City St George’s University of London(伦敦城市圣乔治大学数学系) IT University of Copenhagen(哥本哈根IT大学) Pioneer Centre for AI, Copenhagen(哥本哈根先锋人工智能中心) Departament de Física, Universitat Politècnica de Catalunya(加泰罗尼亚理工大学物理系)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22192 2025-10-28 cs.AI 85%

OptiTree: Hierarchical Thoughts Generation with Tree Search for LLM Optimization Modeling

Haoyang Liu, Jie Wang, Yuyang Cai, Xiongwei Han, Yufei Kuang, Jianye Hao

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发式感知与认知联合实验室,中国科学技术大学) Noah’s Ark Lab, Huawei Technologies(华为诺亚实验室) Tianjin University(天津大学)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments Published at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04654 2025-10-28 cs.AI 84%

E-bike agents: Large Language Model-Driven E-Bike Accident Analysis and Severity Prediction

Zhichao Yang, Jiashu He, Mohammad B. Al-Khasawneh, Darshan Pandit, Cirillo Cinzia

机构 * Civil and Environmental Engineering, University of Maryland(大学工程学院) Computer and Information Science, University of Pennsylvania(大学计算机与信息科学学院)

专题命中 其他LLM :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23271 2025-10-28 cs.CL 83%

Mubeen AI: A Specialized Arabic Language Model for Heritage Preservation and User Intent Understanding

Mohammed Aljafari, Ismail Alturki, Ahmed Mori, Yehya Kadumi

专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 21 pages, 2 figures, 3 tables. Includes appendices on ethical guidelines and training framework. Submitted September 04, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08222 2025-10-28 cs.CV cs.AI cs.CY cs.HC 83%

Refusal as Silence: Gendered Disparities in Vision-Language Model Responses

Sha Luo, Sang Jung Kim, Zening Duan, Kaiping Chen

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏