arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-29 至 2025-10-29 共收录 186 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 15 篇

2510.24010 2025-10-29 cs.CV cs.AI cs.LG 84%

Mars-Bench: A Benchmark for Evaluating Foundation Models for Mars Science Tasks

Mirali Purohit, Bimal Gajera, Vatsal Malaviya, Irish Mehta, Kunal Kasodekar, Jacob Adler, Steven Lu, Umaa Rebbapragada, Hannah Kerner

机构 * School of Computing and Augmented Intelligence, Arizona State University(计算与增强智能学院,亚利桑那州立大学) School of Earth and Space Exploration, Arizona State University(地球与空间探索学院,亚利桑那州立大学) Jet Propulsion Laboratory, California Institute of Technology(喷气推进实验室,加州理工学院)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23884 2025-10-29 cs.CL 83%

Language Models for Longitudinal Clinical Prediction

Tananun Songdechakraiwut, Michael Lutz

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23626 2025-10-29 cs.LG cs.AI cs.CL 80%

From Detection to Discovery: A Closed-Loop Approach for Simultaneous and Continuous Medical Knowledge Expansion and Depression Detection on Social Media

Shuang Geng, Wenli Zhang, Jiaheng Xie, Rui Wang, Sudha Ram

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Presented at SWAIB2025 and HICSS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04444 2025-10-29 cs.DL 80%

Data Discovery using LLMs -- A Study of Data User Behaviour

Christin Katharina Kreutz, Anja Perry, Tanja Friedrich

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted as full paper at TPDL'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15256 2025-10-29 cs.CV 78%

Normal and Abnormal Pathology Knowledge-Augmented Vision-Language Model for Anomaly Detection in Pathology Images

Jinsol Song, Jiamu Wang, Anh Tien Nguyen, Keunho Byeon, Sangjeong Ahn, Sung Hak Lee, Jin Tae Kwak

机构 * Korea University(韩国大学) The Catholic University of Korea(韩国天主大学)

专题命中 领域大模型 :language model(title,abstract)

Comments Accepted to ICCV 2025. Code is available at: https://github.com/QuIIL/ICCV2025_Ano-NAViLa

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24431 2025-10-29 cs.IR cs.AI 77%

MiniOneRec: An Open-Source Framework for Scaling Generative Recommendation

Xiaoyu Kong, Leheng Sheng, Junfei Tan, Yuxin Chen, Jiancan Wu, An Zhang, Xiang Wang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24677 2025-10-29 cs.CL cs.AI 73%

Dissecting Role Cognition in Medical LLMs via Neuronal Ablation

Xun Liang, Huayi Lai, Hanyu Wang, Wentao Zhang, Linfeng Zhang, Yanfang Chen, Feiyu Xiong, Zhiyu Li

机构 * School of Information, Renmin University of China(中国人民大学信息学院) Center of Machine Learning Research, Peking University(北京大学机器学习研究中心) School of Artificial Intelligence, Shanghai Jiaotong University(上海交通大学人工智能学院) Health Informatics Committee of the China Society for Scientific and Technical Information, Renmin University of China(中国科学技术信息学会健康信息技术委员会,中国人民大学) Institute for Advanced Algorithms Research (IAAR), Shanghai, China(先进算法研究所(IAAR),上海,中国) Memtensor Research Center, Shanghai, China(Memtensor研究中心,上海,中国)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23998 2025-10-29 cs.CL 70%

PICOs-RAG: PICO-supported Query Rewriting for Retrieval-Augmented Generation in Evidence-Based Medicine

Mengzhou Sun, Sendong Zhao, Jianyu Chen, Bin Qin

机构 * Faculty of Computing(计算学院) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23946 2025-10-29 cs.CL 57%

Leveraging LLMs for Early Alzheimer's Prediction

Tananun Songdechakraiwut

机构 * Department of Computer Science(计算机科学系) Duke University(杜克大学)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23817 2025-10-29 cs.LG stat.ME 57%

Combining SHAP and Causal Analysis for Interpretable Fault Detection in Industrial Processes

Pedro Cortes dos Santos, Matheus Becali Rocha, Renato A Krohling

机构 * Labcin - Nature Inspired Computing Laboratory(自然启发计算实验室) Graduate Program in Computer Science, Federal University of Espírito Santo(计算机科学研究生项目,巴西圣埃里希托萨大学)

专题命中 领域大模型 :prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20123 2025-10-29 cs.HC 50%

"Learning Together": AI-Mediated Support for Parental Involvement in Everyday Learning

Yao Li, Jingyi Xie, Ya-Fang Lin, He Zhang, Ge Wang, Gaojian Huang, Rui Yu, Si Chen

专题命中 领域大模型 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 9 篇

2507.02937 2025-10-29 cs.LG cs.AI 86%

FoGE: Fock Space inspired encoding for graph prompting

Sotirios Panagiotis Chytas, Rudrasis Chakraborty, Vikas Singh

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Lawrence Livermore National Lab(劳伦斯利弗莫尔国家实验室)

专题命中 知识编辑与模型理解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24505 2025-10-29 cs.CL 85%

CritiCal: Can Critique Help LLM Uncertainty or Confidence Calibration?

Qing Zong, Jiayu Liu, Tianshi Zheng, Chunyang Li, Baixuan Xu, Haochen Shi, Weiqi Wang, Zhaowei Wang, Chunkit Chan, Yangqiu Song

机构 * Department of Computer Science and Engineering, HKUST(计算机科学与工程系,香港科技大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24408 2025-10-29 cs.CR cs.NI 85%

Uncovering Gaps Between RFC Updates and TCP/IP Implementations: LLM-Facilitated Differential Checks on Intermediate Representations

Yifan Wu, Xuewei Feng, Yuxiang Yang, Ke Xu

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24120 2025-10-29 cs.LG 77%

Graph-Guided Concept Selection for Efficient Retrieval-Augmented Generation

Ziyu Liu, Yijing Liu, Jianfei Yuan, Minzhi Yan, Le Yue, Honghui Xiong, Yi Yang

机构 * Huawei Cloud Computing Technology Co., Ltd, China(华为云计算技术有限公司,中国)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23464 2025-10-29 cs.AI 74%

The Confidence Paradox: Can LLM Know When It's Wrong

Sahil Tripathi, Md Tabrez Nafis, Imran Hussain, Jiechao Gao

机构 * Jamia Hamdard(贾迈亚哈姆达德大学) Center for SDGC, Stanford University(SDGC中心,斯坦福大学)

专题命中 知识编辑与模型理解 :LLM(title);分类 cs.AI

Comments Accepted at the 14th IJCNLP & 4th AACL 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22366 2025-10-29 cs.LG cs.AI cs.CV 73%

One-Step is Enough: Sparse Autoencoders for Text-to-Image Diffusion Models

Viacheslav Surkov, Chris Wendler, Antonio Mari, Mikhail Terekhov, Justin Deschenaux, Robert West, Caglar Gulcehre, David Bau

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24259 2025-10-29 cs.CL cs.RO 70%

Can LLMs Translate Human Instructions into a Reinforcement Learning Agent's Internal Emergent Symbolic Representation?

Ziqi Ma, Sao Mai Nguyen, Philippe Xu

机构 * U2IS, ENSTA, IP-Paris(U2IS、ENSTA、IP-巴黎)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23458 2025-10-29 cs.CL cs.AI 62%

BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents

Litu Ou, Kuan Li, Huifeng Yin, Liwen Zhang, Zhongwang Zhang, Xixi Wu, Rui Ye, Zile Qiao, Pengjun Xie, Jingren Zhou, Yong Jiang

机构 * Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL、cs.AI

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24459 2025-10-29 cs.AI cs.MA cs.SE 57%

Affordance Representation and Recognition for Autonomous Agents

Habtom Kahsay Gidey, Niklas Huber, Alexander Lenz, Alois Knoll

机构 * Technische Universität München(慕尼黑技术大学) Jessy Works(杰西工作)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

Journal ref The Second International Workshop on Hypermedia Multi-Agent Systems (HyperAgents 2025), in conjunction with the 28th European Conference on Artificial Intelligence (ECAI 2025); October 26, 2025, Bologna, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他LLM 16 篇

2411.14571 2025-10-29 cs.CR cs.AI cs.CL cs.HC 86%

Learned, Lagged, LLM-splained: LLM Responses to End User Security Questions

Vijay Prakash, Kevin Lee, Arkaprabha Bhattacharya, Danny Yuxing Huang, Jessica Staddon

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14291 2025-10-29 cs.LG cs.SI stat.ML 79%

Equivariance Everywhere All At Once: A Recipe for Graph Foundation Models

Ben Finkelshtein, İsmail İlkan Ceylan, Michael Bronstein, Ron Levie

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11390 2025-10-29 cs.CL cs.LG 79%

Says Who? Effective Zero-Shot Annotation of Focalization

Rebecca M. M. Hicke, Yuri Bizzoni, Pascale Feldkamp, Ross Deans Kristensen-McLachlan

机构 * Department of Computer Science, Cornell University(计算机科学系,康奈尔大学) Center for Humanities Computing, Aarhus University(人文学计算中心,奥胡斯大学) Department of Linguistics, Cognitive Science, and Semiotics, Aarhus University(语言学、认知科学与符号学系,奥胡斯大学) TEXT - Center for the Contemporary Cultures of Text, Aarhus University(文本当代文化中心,奥胡斯大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at CHR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22092 2025-10-29 cs.AI 77%

VIRAL: Vision-grounded Integration for Reward design And Learning

Valentin Cuzin-Rambaud, Emilien Komlenovic, Alexandre Faure, Bruno Yun

机构 * Université Claude Bernard Lyon 1(克莱尔伯恩大学里昂1分校) CNRS(国家科学研究中心) Ecole Centrale de Lyon(里昂中央理工学院) INSA Lyon(里昂工业高等学院) Université Lumière Lyon 2(里昂2大学卢米埃尔分校) LIRIS(图像研究所)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13898 2025-10-29 cs.LG cs.AI cs.NE 76%

Do Language Models Use Their Depth Efficiently?

Róbert Csordás, Christopher D. Manning, Christopher Potts

机构 * Stanford University(斯坦福大学)

专题命中 其他LLM :language model(title);分类 cs.AI、cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24180 2025-10-29 cs.LG 70%

V-SAT: Video Subtitle Annotation Tool

Arpita Kundu, Joyita Chakraborty, Anindita Desarkar, Aritra Sen, Srushti Anil Patil, Vishwanathan Raman

机构 * LTIMindTree

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.07647 2025-10-29 cs.CV cs.LG cs.LO 70%

LASER: A Neuro-Symbolic Framework for Learning Spatial-Temporal Scene Graphs with Weak Supervision

Jiani Huang, Ziyang Li, Mayur Naik, Ser-Nam Lim

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Central Florida(中央佛罗里达大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted at International Conference on Learning Representations (ICLR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24582 2025-10-29 cs.CY 67%

Politically Speaking: LLMs on Changing International Affairs

Xuenan Cao, Wai Kei Chung, Ye Zhao, Lidia Mengyuan Zhou

专题命中 其他LLM :LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23924 2025-10-29 cs.CL cs.AI 62%

Agent-based Automated Claim Matching with Instruction-following LLMs

Dina Pisarevskaya, Arkaitz Zubiaga

机构 * Queen Mary University of London(伦敦大学女王学院)

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted for the International Joint Conference on Natural Language Processing & Asia-Pacific Chapter of the Association for Computational Linguistics (2025) Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02787 2025-10-29 cs.CV cs.AI cs.CL 62%

Navigation with VLM framework: Towards Going to Any Language

Zecheng Yin, Chonghao Cheng, and Yao Guo, Zhen Li

机构 * Future Network of Intelligence Institute(Shenzhen)(智能未来网络研究所(深圳)) University of Technology Sydney(悉尼技术大学) Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hongkong(Shenzhen)(香港中文大学(深圳))

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏