arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-29 至 2025-07-29 共收录 242 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 19 篇

2406.00222 2025-07-29 cs.CL cs.AI cs.LG 83%

Learning to Clarify: Multi-turn Conversations with Action-Based Contrastive Self-Training

Maximillian Chen, Ruoxi Sun, Tomas Pfister, Sercan Ö. Arık

机构 * Google(谷歌) Columbia University(哥伦比亚大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments ICLR 2025; Code: https://github.com/google-research/google-research/tree/master/learning_to_clarify

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00582 2025-07-29 cs.AI 83%

Do Language Models Mirror Human Confidence? Exploring Psychological Insights to Address Overconfidence in LLMs

Chenjun Xu, Bingbing Wen, Bin Han, Robert Wolfe, Lucy Lu Wang, Bill Howe

机构 * University of Washington(华盛顿大学) Allen Institute for AI(人工智能研究所)

专题命中 指令微调 :language model(title);LLM(abstract);prompting(abstract);分类 cs.AI

Comments Accepted by ACL 2025 Findings, 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03726 2025-07-29 cs.CV cs.CL 79%

Otter: A Multi-Modal Model with In-Context Instruction Tuning

Bo Li, Yuanhan Zhang, Liangyu Chen, Jinghao Wang, Fanyi Pu, Joshua Adrian Cahyono, Jingkang Yang, Ziwei Liu

专题命中 指令微调 :instruction tuning(title,abstract);分类 cs.CL

Comments Accepted by IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20972 2025-07-29 astro-ph.IM astro-ph.SR 78%

Finetuning Stellar Spectra Foundation Models with LoRA

Xiaosheng Zhao, Yuan-Sen Ting, Alexander S. Szalay, Yang Huang

专题命中 指令微调 :foundation model(title,abstract)

Comments 7 pages, 2 figures. Accepted to the Machine Learning for Astrophysics (ML4Astro) Colocated Workshop at ICML 2025. Presented as a spotlight talk

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15480 2025-07-29 cs.CV 78%

One Last Attention for Your Vision-Language Model

Liang Chen, Ghazi Shazan Ahmad, Tianjun Yao, Lingqiao Liu, Zhiqiang Shen

专题命中 指令微调 :language model(title,abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19299 2025-07-29 cs.CL eess.SP 77%

The Impact of LoRA Adapters on LLMs for Clinical Text Classification Under Computational and Data Constraints

Thanh-Dung Le, Ti Ti Nguyen, Vu Nguyen Ha, Symeon Chatzinotas, Philippe Jouvet, Rita Noumeir

机构 * Biomedical Information Processing Lab, \' E cole de Technologie Sup\' e rieure, Montr\' e al, Qu\' e bec, Canada The Interdisciplinary Centre for Security, Reliability Trust (SnT), University of Luxembourg, Luxembourg CHU Sainte-Justine Research Center, CHU Sainte-Justine Hospital, University of Montreal, Montr\' e al, Qu\' e bec, Canada

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted for publication in the IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20111 2025-07-29 cs.CL cs.AI 73%

AI-Driven Generation of Old English: A Framework for Low-Resource Languages

Rodrigo Gabriel Salazar Alva, Matías Nuñez, Cristian López, Javier Martín Arista

机构 * Universidad de Ingeniería y Tecnología (UTEC)(Ingeniería y Tecnología大学(UTEC)) Consejo Nacional de Investigaciones Científicas y Técnicas (CONICET)(国家科学与技术研究理事会(CONICET)) Instituto de Investigaciones en Biodiversidad y Medioambiente (INIBIOMA), Universidad Nacional del Comahue(生物多样性与环境研究所(INIBIOMA),Comahue国立大学) Universidad de La Rioja(拉里奥ja大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19679 2025-07-29 cs.CV cs.AI 70%

Efficient Learning for Product Attributes with Compact Multimodal Models

Mandar Kulkarni

机构 * Flipkart Data Science(Flipkart数据科学)

专题命中 指令微调 :language model(abstract);preference optimization(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05713 2025-07-29 cs.LG 57%

Come Together, But Not Right Now: A Progressive Strategy to Boost Low-Rank Adaptation

Zhan Zhuang, Xiequn Wang, Wei Li, Yulong Zhang, Qiushi Huang, Shuhao Chen, Xuehao Wang, Yanbin Wei, Yuhe Nie, Kede Ma, Yu Zhang, Ying Wei

机构 * Southern University of Science(南方科技大学) City University of Hong Kong(香港城市大学) Zhejiang University(浙江大学) Hong Kong University of Science(香港科学大学) University of Surrey(萨里大学) New York University(纽约大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

Comments Accepted by ICML 2025. Code link: https://github.com/zwebzone/coto

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20186 2025-07-29 cs.CV eess.IV 50%

SAMwave: Wavelet-Driven Feature Enrichment for Effective Adaptation of Segment Anything Model

Saurabh Yadav, Avi Gupta, Koteswar Rao Jerripothula

机构 * IIIT Delhi(印度德里理工学院) IIT Kanpur(印度坎pur理工学院)

专题命中 指令微调 :foundation model(abstract)

Comments Accepted to BMVC 2025. The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 后训练与偏好优化 10 篇

2507.20000 2025-07-29 cs.AI cs.DL 89%

Matching Game Preferences Through Dialogical Large Language Models: A Perspective

Renaud Fabre, Daniel Egret, Patrice Bellot

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 28 pages, 1 figure. Published in Applied Sciences

Journal ref Applied Sciences, 2025, 15(15), 8307

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12854 2025-07-29 cs.CL 89%

Enhancing LLM Reasoning with Iterative DPO: A Comprehensive Empirical Investigation

Songjun Tu, Jiahao Lin, Xiangyu Tian, Qichao Zhang, Linjing Li, Yuqian Fu, Nan Xu, Wei He, Xiangyuan Lan, Dongmei Jiang, Dongbin Zhao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Pengcheng Laboratory(鹏城实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Wenge Technology(文生科技) Fudan University(复旦大学)

专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments 23pages

Journal ref COLM2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20181 2025-07-29 cs.CL cs.AI 88%

SGPO: Self-Generated Preference Optimization based on Self-Improver

Hyeonji Lee, Daejin Jo, Seohwan Yun, Sungwoong Kim

机构 * Korea University(韩国大学)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20150 2025-07-29 cs.AI cs.CL cs.LG 88%

The Policy Cliff: A Theoretical Analysis of Reward-Policy Maps in Large Language Models

Xingcheng Xu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 后训练与偏好优化 :large language model(title);language model(title);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02193 2025-07-29 cs.AI 84%

More is Less: The Pitfalls of Multi-Model Synthetic Preference Data in DPO Safety Alignment

Yifan Wang, Runjin Chen, Bolian Li, David Cho, Yihe Deng, Ruqi Zhang, Tianlong Chen, Zhangyang Wang, Ananth Grama, Junyuan Hong

机构 * Purdue University(普渡大学) The University of Texas at Austin(德克萨斯大学奥斯汀分校) The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);post-training(abstract);RLHF(abstract)

Comments This version includes updated results and expanded discussion

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06645 2025-07-29 cs.CL cs.AI 82%

FocalPO: Enhancing Preference Optimizing by Focusing on Correct Preference Rankings

Tong Liu, Xiao Yu, Wenxuan Zhou, Jindong Gu, Volker Tresp

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20566 2025-07-29 cs.AI 79%

Unlearning of Knowledge Graph Embedding via Preference Optimization

Jiajun Liu, Wenjun Ke, Peng Wang, Yao He, Ziyu Shang, Guozheng Li, Zijie Xu, Ke Ji

专题命中 后训练与偏好优化 :preference optimization(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20335 2025-07-29 cs.LG cs.AI 79%

Cultivating Helpful, Personalized, and Creative AI Tutors: A Framework for Pedagogical Alignment using Reinforcement Learning

Siyu Song, Wentao Liu, Ye Lu, Ruohua Zhang, Tao Liu, Jinze Lv, Xinyun Wang, Aimin Zhou, Fei Tan, Bo Jiang, Hao Hao

机构 * Shanghai Innavation Institute(上海创新研究院) Shanghai Institute of AI for Education(上海人工智能教育研究院) School of Computer Science and Technology(计算机科学与技术学院) Department of Educational Information Technology(教育信息技术系)

专题命中 后训练与偏好优化 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10505 2025-07-29 cs.LG cs.CL stat.ML 73%

Preference learning made easy: Everything should be understood through win rate

Lily H. Zhang, Rajesh Ranganath

机构 * Center for Data Science, New York University, New York, USA(数据科学中心,纽约大学,纽约,美国) Courant Institute, New York University, New York, USA(柯朗研究所,纽约大学,纽约,美国)

专题命中 后训练与偏好优化 :SFT(abstract);RLHF(abstract);分类 cs.CL、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20880 2025-07-29 cs.SD cs.AI 57%

JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment

Renhang Liu, Chia-Yu Hung, Navonil Majumder, Taylor Gautreaux, Amir Ali Bagherzadeh, Chuan Li, Dorien Herremans, Soujanya Poria

专题命中 后训练与偏好优化 :preference optimization(abstract);分类 cs.AI

Comments https://github.com/declare-lab/jamify

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 长上下文与记忆 6 篇

2410.23771 2025-07-29 cs.CL cs.LG 84%

What is Wrong with Perplexity for Long-context Language Modeling?

Lizhe Fang, Yifei Wang, Zhaoyang Liu, Chenheng Zhang, Stefanie Jegelka, Jinyang Gao, Bolin Ding, Yisen Wang

机构 * State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(一般人工智能国家重点实验室,智能科学与技术学院,北京大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Alibaba Group(阿里巴巴集团) TUM CIT, MCML, MDSI(技术大学(TUM) CIT、MCML、MDSI) MIT EECS, CSAIL(麻省理工学院电子工程与计算机科学系,计算机科学与人工智能实验室) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08026 2025-07-29 cs.CL cs.AI 73%

In Prospect and Retrospect: Reflective Memory Management for Long-term Personalized Dialogue Agents

Zhen Tan, Jun Yan, I-Hung Hsu, Rujun Han, Zifeng Wang, Long T. Le, Yiwen Song, Yanfei Chen, Hamid Palangi, George Lee, Anand Iyer, Tianlong Chen, Huan Liu, Chen-Yu Lee, Tomas Pfister

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20215 2025-07-29 cs.MA 71%

MLC-Agent: Cognitive Model based on Memory-Learning Collaboration in LLM Empowered Agent Simulation Environment

Ming Zhang, Yiling Xuan, Qun Ma, Yuwei Guo

专题命中 长上下文与记忆 :LLM(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20030 2025-07-29 cs.CL 70%

FAEDKV: Infinite-Window Fourier Transform for Unbiased KV Cache Compression

Runchao Li, Yao Fu, Mu Sheng, Xianxuan Long, Haotian Yu, Pan Li

机构 * Case Western Reserve University(凯斯西储大学)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13632 2025-07-29 cs.CL 70%

DoubleDipper: Improving Long-Context LLMs via Context Recycling

Arie Cattan, Alon Jacovi, Alex Fabrikant, Jonathan Herzig, Roee Aharoni, Hannah Rashkin, Dror Marcus, Avinatan Hassidim, Yossi Matias, Idan Szpektor, Avi Caciularu

机构 * Bar-Ilan University(巴伊兰大学) Google Research(谷歌研究) Google DeepMind(谷歌DeepMind)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20145 2025-07-29 cs.CL cs.AI 62%

Multi-Agent Interactive Question Generation Framework for Long Document Understanding

Kesen Wang, Daulet Toibazar, Abdulrahman Alfulayt, Abdulaziz S. Albadawi, Ranya A. Alkahtani, Asma A. Ibrahim, Haneen A. Alhomoud, Sherif Mohamed, Pedro J. Moreno

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 推理与问题求解 24 篇

2505.20308 2025-07-29 cs.IR cs.AI 90%

Large Language Model Powered Decision Support for a Metal Additive Manufacturing Knowledge Graph

Muhammad Tayyab Khan, Lequn Chen, Wenhe Feng, Seung Ki Moon

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments The paper has been accepted at 11th International Conference of Asian Society for Precision Engineering and Nanotechnology

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20509 2025-07-29 cs.RO cs.AI cs.SY eess.SY 89%

LLMs-guided adaptive compensator: Bringing Adaptivity to Automatic Control Systems with Large Language Models

Zhongchao Zhou, Yuxi Lu, Yaonan Zhu, Yifan Zhao, Bin He, Liang He, Wenwen Yu, Yusuke Iwasawa

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19748 2025-07-29 cs.CL 89%

JT-Math: A Multi-Stage Framework for Advanced Mathematical Reasoning in Large Language Models

Yifan Hao, Fangning Chao, Yaqian Hao, Zhaojun Cui, Huan Bai, Haiyu Zhang, Yankai Liu, Chao Deng, Junlan Feng

机构 * China Mobile Research Institute Beijing, China(中国移动研究院北京)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19616 2025-07-29 cs.CL 89%

HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track

Xuchen Wei, Yangxin Wu, Yaoyin Zhang, Henglyu Liu, Kehai Chen, Xuefeng Bai, Min Zhang

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen, China(计算机科学与技术学院,哈尔滨工业大学(深圳))

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 7 pages, 1 figure, submitted to IWSLT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏