arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-26 至 2025-09-26 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 14 篇

2509.20811 2025-09-26 cs.CL cs.AI 88%

Leveraging What's Overfixed: Post-Correction via LLM Grammatical Error Overcorrection

Taehee Park, Heejin Do, Gary Geunbae Lee

机构 * Graduate School of Artificial Intelligence, POSTECH, South Korea(POSTECH人工智能研究生院) ETH Zurich, ETH AI Center(苏黎世联邦理工学院人工智能中心) Department of Computer Science and Engineering, POSTECH, South Korea(POSTECH计算机科学与工程系)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20957 2025-09-26 cs.CL 87%

Tool Calling for Arabic LLMs: Data Strategies and Instruction Tuning

Asim Ersoy, Enes Altinisik, Husrev Taha Sencar, Kareem Darwish

机构 * Qatar Computing Research Institute, HBKU(卡塔尔计算研究所,哈塔姆大学)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Journal ref ArabicNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20805 2025-09-26 cs.CL cs.IR 85%

Few-Shot and Training-Free Review Generation via Conversational Prompting

Genki Kusano

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12010 2025-09-26 cs.LG cs.AI cs.CL 84%

Bias Similarity Measurement: A Black-Box Audit of Fairness Across LLMs

Hyejun Jeong, Shiqing Ma, Amir Houmansadr

机构 * UMass Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 指令微调 :LLM(abstract,comments);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Code available at https://github.com/HyejunJeong/bias_llm

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20107 2025-09-26 cs.CV cs.AI cs.LG cs.RO 81%

Hyperspectral Adapter for Semantic Segmentation with Vision Foundation Models

Juana Valeria Hurtado, Rohit Mohan, Abhinav Valada

机构 * Department of Computer Science, University of Freiburg(弗赖堡大学计算机科学系) Baden-Württemberg Stiftung gGmbH(巴登-符腾堡基金会) Bosch Research(博世研究)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21241 2025-09-26 cs.LG cs.AI 79%

Explaining Fine Tuned LLMs via Counterfactuals A Knowledge Graph Driven Framework

Yucheng Wang, Ziyang Chen, Md Faisal Kabir

机构 * Penn State Harrisburg(宾夕法尼亚州立大学哈里斯堡分校)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21050 2025-09-26 cs.LG cs.AI 79%

GeoRef: Referring Expressions in Geometry via Task Formulation, Synthetic Supervision, and Reinforced MLLM-based Solutions

Bing Liu, Wenqiang Yv, Xuzheng Yang, Shichang Wang, Junzhuo Liu, Peng Wang, Guoqing Wang, Yang Yang, Heng Tao Shen

机构 * University of Electronic Science and Technology of China(电子科技大学) Tongji University(同济大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21273 2025-09-26 cs.CV 78%

A Sentinel-3 foundation model for ocean colour

Geoffrey Dawson, Remy Vandaele, Andrew Taylor, David Moffat, Helen Tamura-Wicks, Sarah Jackson, Rosie Lickorish, Paolo Fraccaro, Hywel Williams, Chunbo Luo, Anne Jones

机构 * IBM Research Europe(IBM欧洲研究院) University of Exeter(埃克塞特大学) STFC Hartree Centre(科学与技术设施委员会哈特里中心) Plymouth Marine Laboratory National Center for Earth Observation(普利茅斯海洋实验室地球观测国家中心)

专题命中 指令微调 :foundation model(title,abstract)

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14613 2025-09-26 cs.CL 70%

When Does Meaning Backfire? Investigating the Role of AMRs in NLI

Junghyun Min, Xiulin Yang, Shira Wein

机构 * Georgetown University(乔治城大学) Amherst College(阿默斯特学院)

专题命中 指令微调 :language model(abstract);prompting(abstract);分类 cs.CL

Comments 9 pages, 2 figures. *SEM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18435 2025-09-26 cs.CV cs.CL 70%

On the Perception Bottleneck of VLMs for Chart Understanding

Junteng Liu, Weihao Zeng, Xiwen Zhang, Yijun Wang, Zifei Shan, Junxian He

机构 * The Hong Kong University of Science and Technology(香港理工大学)

专题命中 指令微调 :language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments EMNLP 2025: Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18056 2025-09-26 cs.CV 67%

TempSamp-R1: Effective Temporal Sampling with Reinforcement Fine-Tuning for Video LLMs

Yunheng Li, Jing Cheng, Shaoyong Jia, Hangyi Kuang, Shaohui Jiao, Qibin Hou, Ming-Ming Cheng

机构 * VCIP, School of Computer Science, Nankai University(VCIP,计算机科学学院,南开大学) ByteDance Inc.(字节跳动公司)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21107 2025-09-26 cs.RO cs.AI cs.CV cs.LG 62%

Cross-Modal Instructions for Robot Motion Generation

William Barron, Xiaoxiang Dong, Matthew Johnson-Roberson, Weiming Zhi

机构 * College of Connected Computing, Vanderbilt University(连接计算学院,范德比尔特大学) Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学) School of Computer Science, The University of Sydney(计算机科学学院,悉尼大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20792 2025-09-26 cs.CV cs.AI cs.LG 62%

DAC-LoRA: Dynamic Adversarial Curriculum for Efficient and Robust Few-Shot Adaptation

Ved Umrajkar

机构 * Indian Institute of Technology, Roorkee(印度理工学院拉胡尔分校)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICCV2025 Workshop on Safe and Trustworthy Multimodal AI Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20858 2025-09-26 cs.GR cs.CV cs.MM 50%

ArchGPT: Understanding the World's Architectures with Large Multimodal Models

Yuze Wang, Luo Yang, Junyi Wang, Yue Qi

机构 * State Key Laboratory of Virtual Reality Technology and Systems(虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering(计算机科学与工程学院) Beihang University(北京航空航天大学) School of Computer Science and Technology(计算机科学与技术学院) Shandong University(山东大学)

专题命中 指令微调 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏