arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-15 至 2025-09-15 共收录 116 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 5 篇

2509.10369 2025-09-15 cs.LG cs.AI eess.SP q-bio.TO 84%

Data distribution impacts the performance and generalisability of contrastive learning-based foundation models of electrocardiograms

Gul Rukh Khattak, Konstantinos Patlatzoglou, Joseph Barker, Libor Pastika, Boroumand Zeidaabadi, Ahmed El-Medany, Hesham Aggour, Yixiu Liang, Antonio H. Ribeiro, Jeffrey Annis, Antonio Luiz Pinho Ribeiro, Junbo Ge, Daniel B. Kramer, Jonathan W. Waks, Evan Brittain, Nicholas Peters, Fu Siong Ng, Arunashis Sau

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments Currently under review at npj Digital Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07890 2025-09-15 cs.CV 82%

Can Generative Geospatial Diffusion Models Excel as Discriminative Geospatial Foundation Models?

Yuru Jia, Valerio Marsocci, Ziyang Gong, Xue Yang, Maarten Vergauwen, Andrea Nascetti

机构 * KU Leuven(鲁汶大学) KTH(皇家理工学院) European Space Agency(欧洲航天局) Shanghai AI Lab(上海人工智能实验室) SJTU(上海交通大学)

专题命中 预训练与数据 :foundation model(title,abstract);pretraining(abstract)

Comments ICCV 2025, camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13798 2025-09-15 cs.CL cs.AI cs.IT math.IT 81%

Slaves to the Law of Large Numbers: An Asymptotic Equipartition Property for Perplexity in Generative Language Models

Tyler Bell, Avinash Mudireddy, Ivan Johnson-Eversoll, Soura Dasgupta, Raghu Mudumbai

机构 * University of Iowa(爱荷华大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10108 2025-09-15 cs.CL 70%

Scaling Arabic Medical Chatbots Using Synthetic Data: Enhancing Generative AI with Synthetic Patient Records

Abdulrahman Allam, Seif Ahmed, Ali Hamdi, Khaled Shaban

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09943 2025-09-15 cs.CV 50%

Segment Anything for Cell Tracking

Zhu Chen, Mert Edgü, Er Jin, Johannes Stegmaier

机构 * Institute of Imaging and Computer Vision, RWTH Aachen University, Germany(成像与计算机视觉研究所,亚琛工业大学,德国)

专题命中 预训练与数据 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 6 篇

2509.09689 2025-09-15 cs.IR cs.AI cs.CL cs.LG 91%

Personas within Parameters: Fine-Tuning Small Language Models with Low-Rank Adapters to Mimic User Behaviors

Himanshu Thakur, Eshani Agrawal, Smruthi Mukund

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10396 2025-09-15 cs.LG 88%

Inpainting-Guided Policy Optimization for Diffusion Large Language Models

Siyan Zhao, Mengchen Liu, Jing Huang, Miao Liu, Chenyu Wang, Bo Liu, Yuandong Tian, Guan Pang, Sean Bell, Aditya Grover, Feiyu Chen

机构 * Meta Superintelligence Labs(Meta超智能实验室) Tsinghua University, College of AI(清华大学人工智能学院) MIT(麻省理工学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

Comments preprint; 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05394 2025-09-15 cs.CR cs.LG 79%

Attacking Attention of Foundation Models Disrupts Downstream Tasks

Hondamunige Prasanna Silva, Federico Becattini, Lorenzo Seidenari

机构 * University of Florence(佛罗伦萨大学) University of Siena(锡耶纳大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

Comments Paper published at CVPR 2025 Workshop Advml

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10208 2025-09-15 cs.CL cs.AI 79%

SI-FACT: Mitigating Knowledge Conflict via Self-Improving Faithfulness-Aware Contrastive Tuning

Shengqiang Fu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07980 2025-09-15 cs.CL 77%

Parallel-R1: Towards Parallel Thinking via Reinforcement Learning

Tong Zheng, Hongming Zhang, Wenhao Yu, Xiaoyang Wang, Runpeng Dai, Rui Liu, Huiwen Bao, Chengsong Huang, Heng Huang, Dong Yu

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments Project website: https://zhengkid.github.io/Parallel_R1.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00419 2025-09-15 physics.geo-ph cs.AI 74%

Geological Everything Model 3D: A Promptable Foundation Model for Unified and Zero-Shot Subsurface Understanding

Yimin Dou, Xinming Wu, Nathan L Bangs, Harpreet Singh Sethi, Jintao Li, Hang Gao, Zhixiang Guo

机构 * University of Science and Technology of China, School of Earth and Space Sciences(中国科学技术大学地球和空间科学学院) University of Texas at Austin, UT Institute for Geophysics(德克萨斯大学奥斯汀分校UT地球物理研究所) NVIDIA(NVIDIA公司)

专题命中 指令微调 :foundation model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 3 篇

2503.16365 2025-09-15 cs.CV cs.AI 88%

JARVIS-VLA: Post-Training Large-Scale Vision Language Models to Play Visual Games with Keyboards and Mouse

Muyao Li, Zihao Wang, Kaichen He, Xiaojian Ma, Yitao Liang

机构 * Peking University(北京大学) BIGAI(大疆创新)

专题命中 后训练与偏好优化 :language model(title,abstract);post-training(title,abstract);分类 cs.AI

Comments Accepted by ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14664 2025-09-15 cs.CL 87%

Direct Judgement Preference Optimization

Peifeng Wang, Austin Xu, Yilun Zhou, Caiming Xiong, Shafiq Joty

专题命中 后训练与偏好优化 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09852 2025-09-15 cs.CL 77%

Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization

Chuyuan Li, Austin Xu, Shafiq Joty, Giuseppe Carenini

机构 * Department of Computer Science, University of British Columbia(英属哥伦比亚大学计算机科学系) Salesforce AI Research(Salesforce人工智能研究)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 3 篇

2509.10417 2025-09-15 cs.CL 79%

Long Context Automated Essay Scoring with Language Models

Christopher Ormerod, Gitit Kehat

机构 * Cambium Assessment Inc.(Cambium评估公司)

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL

Comments 8 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18173 2025-09-15 cs.CL 70%

UIO-LLMs: Unbiased Incremental Optimization for Long-Context LLMs

Wenhao Li, Mingbao Lin, Yunshan Zhong, Shuicheng Yan, Rongrong Ji

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

Comments This article was not accepted, and its quality is not very good. Therefore, we have decided to withdraw the submission and will not resubmit it elsewhere

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09754 2025-09-15 cs.LG cs.AI 62%

LAVa: Layer-wise KV Cache Eviction with Dynamic Budget Allocation

Yiqun Shen, Song Yuan, Zhengze Zhang, Xiaoliang Wang, Daxin Jiang, Nguyen Cam-Tu

机构 * State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Artificial Intelligence, Nanjing University(人工智能学院,南京大学) Stepfun

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 10 篇

2412.12039 2025-09-15 cs.CR cs.AI cs.CL cs.SE 91%

Can LLM Prompting Serve as a Proxy for Static Analysis in Vulnerability Detection

Ira Ceka, Feitong Qiao, Anik Dey, Aastha Valecha, Gail Kaiser, Baishakhi Ray

专题命中 推理与问题求解 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09906 2025-09-15 cs.MA cs.AI 88%

Tackling One Health Risks: How Large Language Models are leveraged for Risk Negotiation and Consensus-building

Alexandra Fetsch, Iurii Savvateev, Racem Ben Romdhane, Martin Wiedmann, Artemiy Dimov, Maciej Durkalec, Josef Teichmann, Jakob Zinsstag, Konstantinos Koutsoumanis, Andreja Rajkovic, Jason Mann, Mauro Tonolla, Monika Ehling-Schulz, Matthias Filter, Sophia Johler

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10249 2025-09-15 cs.AI 83%

Investigating Language Model Capabilities to Represent and Process Formal Knowledge: A Preliminary Study to Assist Ontology Engineering

Hanna Abi Akl

机构 * Université Côte d’Azur(法国滨海大学) Inria(法国国家信息与自动化技术研究所) CNRS(法国国家科学研究中心) I3S(国际科学计算研究所) Sophia Antipolis, France(法国索菲亚大学) Data ScienceTech Institute (DSTI)(数据科学技术研究所)

专题命中 推理与问题求解 :language model(title,abstract);small language model(abstract);分类 cs.AI

Comments accepted for the International Joint Conference on Rules and Reasoning (RuleML+RR) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09731 2025-09-15 cs.CL 83%

Benchmarking Vision-Language Models on Chinese Ancient Documents: From OCR to Knowledge Reasoning

Haiyang Yu, Yuchuan Wu, Fan Shi, Lei Liao, Jinghui Lu, Xiaodong Ge, Han Wang, Minghan Zhuo, Xuecheng Wu, Xiang Fei, Hao Feng, Guozhi Tang, An-Lan Wang, Hanshen Zhu, Yangfan He, Quanhuan Liang, Liyuan Meng, Chao Feng, Can Huang, Jingqun Tang, Bin Li

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10106 2025-09-15 cs.RO cs.AI 83%

One For All: LLM-based Heterogeneous Mission Planning in Precision Agriculture

Marcos Abel Zuzuárregui, Mustafa Melih Toslak, Stefano Carpin

机构 * Department of Computer Science(计算机科学系) Engineering University of California, Merced, CA, USA.(加州大学默塞德分校工程学院) Department of Informatics, Bioengineering, Robotics(信息学、生物工程、机器人学系) Systems Engineering, University of Genova, Italy(系统工程系,热那亚大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to International Federation of Automatic Control (IFAC) Sensing, Control and Automation Technologies for Agriculture - 8th AGRICONTROL 2025

Journal ref International Federation of Automatic Control (IFAC) Sensing, Control and Automation Technologies for Agriculture - 8th AGRICONTROL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09790 2025-09-15 cs.AI 77%

How well can LLMs provide planning feedback in grounded environments?

Yuxuan Li, Victor Zhong

机构 * David R. Cheriton School of Computer Science University of Waterloo(大卫·R·切里顿计算机科学学院滑铁卢大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09732 2025-09-15 cs.CV 75%

Decomposing Visual Classification: Assessing Tree-Based Reasoning in VLMs

Sary Elmansoury, Islam Mesabah, Gerrit Großmann, Peter Neigel, Raj Bhalwankar, Daniel Kondermann, Sebastian J. Vollmer

专题命中 推理与问题求解 :LLM(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10297 2025-09-15 cs.AI 70%

The Morality of Probability: How Implicit Moral Biases in LLMs May Shape the Future of Human-AI Symbiosis

Eoin O'Doherty, Nicole Weinrauch, Andrew Talone, Uri Klempner, Xiaoyuan Yi, Xing Xie, Yi Zeng

机构 * Schwarzman College, Tsinghua University(清华大学 Schwarzman 学院) Chinese Academy of Sciences(中国科学院) Microsoft Research Asia(微软亚洲研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10059 2025-09-15 cs.CV cs.AI 70%

Multimodal Mathematical Reasoning Embedded in Aerial Vehicle Imagery: Benchmarking, Analysis, and Exploration

Yue Zhou, Litong Feng, Mengcheng Lan, Xue Yang, Qingyun Li, Yiping Ke, Xue Jiang, Wayne Zhang

机构 * Department of Physics, J.K. Institute of Science(J.K.科学研究院物理系) World Scientific University(世界科学大学) University of Intelligent Studies(智能研究大学) East China Normal University(华东师范大学) Nanyang Technological University(南洋理工大学) SenseTime Research(商汤科技研究院) Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 推理与问题求解 :language model(abstract);prompting(abstract);分类 cs.AI

Comments 17 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10054 2025-09-15 cs.AI 70%

XAgents: A Unified Framework for Multi-Agent Cooperation via IF-THEN Rules and Multipolar Task Processing Graph

Hailong Yang, Mingxian Gu, Jianqi Wang, Guanjin Wang, Zhaohong Deng

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 评测与基准 31 篇

2509.09724 2025-09-15 cs.CL cs.AI cs.LG 91%

DiTTO-LLM: Framework for Discovering Topic-based Technology Opportunities via Large Language Model

Wonyoung Kim, Sujeong Seo, Juhyun Lee

机构 * Department of Library and Information Science(图书馆与信息科学系) Chung-Ang University(Chung-Ang 大学) Insurance Strategy Planning Team(保险战略规划团队) Postal Savings & Insurance Development Institute(邮政储蓄与保险发展研究所) Future Technology Analysis Center(未来技术分析中心) Korea Institute of Science and Technology Information(韩国科学技术信息院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.CL、cs.AI、cs.LG

Comments 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09709 2025-09-15 cs.CL cs.AI 90%

Assisting Research Proposal Writing with Large Language Models: Evaluation and Refinement

Jing Ren, Weiqi Wang

机构 * University of Technology Sydney(悉尼技术大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09918 2025-09-15 cs.SE cs.AI 88%

WALL: A Web Application for Automated Quality Assurance using Large Language Models

Seyed Moein Abtahi, Akramul Azim

机构 * Faculty of Engineering(工程学院) Applied Science Ontario Tech University(应用科学Ontario技术大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏