arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11619 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11619 篇

2507.13575 2025-08-28 cs.LG cs.AI 84%

Apple Intelligence Foundation Language Models: Tech Report 2025

Ethan Li, Anders Boesen Lindbo Larsen, Chen Zhang, Xiyou Zhou, Jun Qin, Dian Ang Yap, Narendran Raghavan, Xuankai Chang, Margit Bowler, Eray Yildiz, John Peebles, Hannah Gillis Coleman, Matteo Ronchi, Peter Gray, Keen You, Anthony Spalvieri-Kruse, Ruoming Pang, Reed Li, Yuli Yang, Emad Soroush, Zhiyun Lu, Crystal Xiao, Rong Situ, Jordan Huffaker, David Griffiths, Zaid Ahmed, Peng Zhang, Daniel Parilla, Asaf Liberman, Jennifer Mallalieu, Parsa Mazaheri, Qibin Chen, Manjot Bilkhu, Aonan Zhang, Eric Wang, Dave Nelson, Michael FitzMaurice, Thomas Voice, Jeremy Liu, Josh Shaffer, Shiwen Zhao, Prasanth Yadla, Farzin Rasteh, Pengsheng Guo, Arsalan Farooq, Jeremy Snow, Stephen Murphy, Tao Lei, Minsik Cho, George Horrell, Sam Dodge, Lindsay Hislop, Sumeet Singh, Alex Dombrowski, Aiswarya Raghavan, Sasha Sirovica, Mandana Saebi, Faye Lao, Max Lam, TJ Lu, Zhaoyang Xu, Karanjeet Singh, Marc Kirchner, David Mizrahi, Rajat Arora, Haotian Zhang, Henry Mason, Lawrence Zhou, Yi Hua, Ankur Jain, Felix Bai, Joseph Astrauskas, Floris Weers, Josh Gardner, Mira Chiang, Yi Zhang, Pulkit Agrawal, Tony Sun, Quentin Keunebroek, Matthew Hopkins, Bugu Wu, Tao Jia, Chen Chen, Xingyu Zhou, Nanzhu Wang, Peng Liu, Ruixuan Hou, Rene Rauch, Yuan Gao, Afshin Dehghan, Jonathan Janke, Zirui Wang, Cha Chen, Xiaoyi Ren, Feng Nan, Josh Elman, Dong Yin, Yusuf Goren, Jeff Lai, Yiran Fei, Syd Evans, Muyang Yu, Guoli Yin, Yi Qin, Erin Feldman, Isha Garg, Aparna Rajamani, Karla Vega, Walker Cheng, TJ Collins, Hans Han, Raul Rea Menacho, Simon Yeung, Sophy Lee, Phani Mutyala, Ying-Chang Cheng, Zhe Gan, Sprite Chu, Justin Lazarow, Alessandro Pappalardo, Federico Scozzafava, Jing Lu, Erik Daxberger, Laurent Duchesne, Jen Liu, David Güera, Stefano Ligas, Mary Beth Kery, Brent Ramerth, Ciro Sannino, Marcin Eichner, Haoshuo Huang, Rui Qian, Moritz Schwarzer-Becker, David Riazati, Mingfei Gao, Bailin Wang, Jack Cackler, Yang Lu, Ransen Niu, John Dennison, Guillaume Klein, Jeffrey Bigham, Deepak Gopinath, Navid Shiee, Darren Botten, Guillaume Tartavel, Alex Guillen Garcia, Sam Xu, Victoria MönchJuan Haladjian, Zi-Yi Dou, Matthias Paulik, Adolfo Lopez Mendez, Zhen Li, Hong-You Chen, Chao Jia, Dhaval Doshi, Zhengdong Zhang, Raunak Manjani, Aaron Franklin, Zhile Ren, David Chen, Artsiom Peshko, Nandhitha Raghuram, Hans Hao, Jiulong Shan, Kavya Nerella, Ramsey Tantawi, Vivek Kumar, Saiwen Wang, Brycen Wershing, Bhuwan Dhingra, Dhruti Shah, Ob Adaranijo, Xin Zheng, Tait Madsen, Hadas Kotek, Chang Liu, Yin Xia, Hanli Li, Suma Jayaram, Yanchao Sun, Ahmed Fakhry, Vasileios Saveris, Dustin Withers, Yanghao Li, Alp Aygar, Andres Romero Mier Y Teran, Kaiwei Huang, Mark Lee, Xiujun Li, Yuhong Li, Tyler Johnson, Jay Tang, Joseph Yitan Cheng, Futang Peng, Andrew Walkingshaw, Lucas Guibert, Abhishek Sharma, Cheng Shen, Piotr Maj, Yasutaka Tanaka, You-Cyuan Jhang, Vivian Ma, Tommi Vehvilainen, Kelvin Zou, Jeff Nichols, Matthew Lei, David Qiu, Yihao Qian, Gokul Santhanam, Wentao Wu, Yena Han, Dominik Moritz, Haijing Fu, Mingze Xu, Vivek Rathod, Jian Liu, Louis D'hauwe, Qin Ba, Haitian Sun, Haoran Yan, Philipp Dufter, Anh Nguyen, Yihao Feng, Emma Wang, Keyu He, Rahul Nair, Sanskruti Shah, Jiarui Lu, Patrick Sonnenberg, Jeremy Warner, Yuanzhi Li, Bowen Pan, Ziyi Zhong, Joe Zhou, Sam Davarnia, Olli Saarikivi, Irina Belousova, Rachel Burger, Shang-Chen Wu, Di Feng, Bas Straathof, James Chou, Yuanyang Zhang, Marco Zuliani, Eduardo Jimenez, Abhishek Sundararajan, Xianzhi Du, Chang Lan, Nilesh Shahdadpuri, Peter Grasch, Sergiu Sima, Josh Newnham, Varsha Paidi, Jianyu Wang, Kaelen Haag, Alex Braunstein, Daniele Molinari, Richard Wei, Brenda Yang, Nicholas Lusskin, Joanna Arreaza-Taylor, Meng Cao, Nicholas Seidl, Simon Wang, Jiaming Hu, Yiping Ma, Mengyu Li, Kieran Liu, Hang Su, Sachin Ravi, Chong Wang, Xin Wang, Kevin Smith, Haoxuan You, Binazir Karimzadeh, Rui Li, Jinhao Lei, Wei Fang, Alec Doane, Sam Wiseman, Ismael Fernandez, Jane Li, Andrew Hansen, Javier Movellan, Christopher Neubauer, Hanzhi Zhou, Chris Chaney, Nazir Kamaldin, Valentin Wolf, Fernando Bermúdez-Medina, Joris Pelemans, Peter Fu, Howard Xing, Xiang Kong, Wayne Shan, Gabriel Jacoby-Cooper, Dongcai Shen, Tom Gunter, Guillaume Seguin, Fangping Shi, Shiyu Li, Yang Xu, Areeba Kamal, Dan Masi, Saptarshi Guha, Qi Zhu, Jenna Thibodeau, Changyuan Zhang, Rebecca Callahan, Charles Maalouf, Wilson Tsao, Boyue Li, Qingqing Cao, Naomy Sabo, Cheng Leong, Yi Wang, Anupama Mann Anupama, Colorado Reed, Kenneth Jung, Zhifeng Chen, Mohana Prasad Sathya Moorthy, Yifei He, Erik Hornberger, Devi Krishna, Senyu Tong, Michael, Lee, David Haldimann, Yang Zhao, Bowen Zhang, Chang Gao, Chris Bartels, Sushma Rao, Nathalie Tran, Simon Lehnerer, Co Giang, Patrick Dong, Junting Pan, Biyao Wang, Dongxu Li, Mehrdad Farajtabar, Dongseong Hwang, Grace Duanmu, Eshan Verma, Sujeeth Reddy, Qi Shan, Hongbin Gao, Nan Du, Pragnya Sridhar, Forrest Huang, Yingbo Wang, Nikhil Bhendawade, Diane Zhu, Sai Aitharaju, Fred Hohman, Lauren Gardiner, Chung-Cheng Chiu, Yinfei Yang, Alper Kokmen, Frank Chu, Ke Ye, Kaan Elgin, Oron Levy, John Park, Donald Zhang, Eldon Schoop, Nina Wenzel, Michael Booker, Hyunjik Kim, Chinguun Erdenebileg, Nan Dun, Eric Liang Yang, Priyal Chhatrapati, Vishaal Mahtani, Haiming Gang, Kohen Chia, Deepa Seshadri, Donghan Yu, Yan Meng, Kelsey Peterson, Zhen Yang, Yongqiang Wang, Carina Peng, Doug Kang, Anuva Agarwal, Albert Antony, Juan Lao Tebar, Albin Madappally Jose, Regan Poston, Andy De Wang, Gerard Casamayor, Elmira Amirloo, Violet Yao, Wojciech Kryscinski, Kun Duan, Lezhi L

机构 * Apple Intelligence Foundation(苹果智能基金会)

专题命中 指令微调 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19279 2025-08-28 cs.CL cs.AI 84%

FLAIRR-TS -- Forecasting LLM-Agents with Iterative Refinement and Retrieval for Time Series

Gunjan Jalori, Preetika Verma, Sercan Ö Arık

专题命中 指令微调 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17926 2025-08-26 cs.CL cs.AI 84%

AMELIA: A Family of Multi-task End-to-end Language Models for Argumentation

Henri Savigny, Bruno Yun

机构 * Universite Claude Bernard Lyon 1(里昂1大学) CNRS(国家科学研究中心) Ecole Centrale de Lyon(里昂中央理工大学) INSA Lyon(里昂国立应用科学学院) Université Lumiere Lyon 2(里昂2大学) LIRIS(图像研究所)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20182 2025-08-25 cs.LG cs.AI q-bio.QM 84%

Chemical Language Model Linker: blending text and molecules with modular adapters

Yifan Deng, Spencer S. Ericksen, Anthony Gitter

机构 * Department of Computer Sciences, University of Wisconsin-Madison(威斯康星大学麦迪逊分校计算机科学系) Drug Development Core, Small Molecule Screening Facility, University of Wisconsin Carbone Cancer Center, University of Wisconsin-Madison(威斯康星大学卡本纳癌症中心药物开发核心、小分子筛选设施) Department of Biostatistics and Medical Informatics, University of Wisconsin-Madison(威斯康星大学麦迪逊分校生物统计学与医学信息学系)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments 63 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00712 2025-08-22 cs.CL cs.LG 84%

Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding

Jiajun Zhu, Peihao Wang, Ruisi Cai, Jason D. Lee, Pan Li, Zhangyang Wang

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Zhejiang University(浙江大学) Princeton University(普林斯顿大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18071 2025-08-12 cs.CL cs.LG 84%

Can Perplexity Predict Fine-tuning Performance? An Investigation of Tokenization Effects on Sequential Language Models for Nepali

Nishant Luitel, Nirajan Bekoju, Anand Kumar Sah, Subarna Shakya

专题命中 指令微调 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments 11 pages

Journal ref Proceedings of the Fourth Workshop on Generation, Evaluation and Metrics (GEM^2), pages 239-248, Vienna, Austria and virtual meeting, Association for Computational Linguistics, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21899 2025-07-30 cs.AI cs.LG cs.SE 84%

LLM-based Content Classification Approach for GitHub Repositories by the README Files

Malik Uzair Mehmood, Shahid Hussain, Wen Li Wang, Muhammad Usama Malik

机构 * Department of Computing and Built Environment(计算与环境系) Birmingham City University(伯明翰城市大学) Department of Computer Science and Software Engineering(计算机科学与软件工程系) School of Engineering(工程学院) Penn State University, Behrend, Erie PA(宾夕法尼亚州立大学贝伦分校,埃里普斯帕州) Department of Electrical Engineering(电气工程系) UET Taxila(塔希尔工程大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10341 2025-07-29 cs.RO cs.AI cs.LG 84%

Affordance-Guided Reinforcement Learning via Visual Prompting

Olivia Y. Lee, Annie Xie, Kuan Fang, Karl Pertsch, Chelsea Finn

机构 * Stanford University(斯坦福大学) Cornell University(康奈尔大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 指令微调 :prompting(title);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 6 figures. IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11851 2025-07-17 cs.CL cs.LG 84%

Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential

Mohammad Samragh, Arnav Kundu, David Harrison, Kumari Nishu, Devang Naik, Minsik Cho, Mehrdad Farajtabar

机构 * Apple(苹果公司)

专题命中 指令微调 :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06396 2025-07-10 cs.AI cs.LG cs.PL cs.SE 84%

Representing Prompting Patterns with PDL: Compliance Agent Case Study

Mandana Vaziri, Louis Mandel, Yuji Watanabe, Hirokuni Kitahara, Martin Hirzel, Anca Sailer

机构 * IBM Research, Yorktown Heights, USA(IBM研究院,Yorktown Heights,美国) IBM Research, Tokyo, Japan(IBM研究院,Tokyo,日本)

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments ICML 2025 Workshop on Programmatic Representations for Agent Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05598 2025-07-09 cs.CL cs.AI 84%

Self-Review Framework for Enhancing Instruction Following Capability of LLM

Sihyun Park

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04250 2025-07-08 cs.LG cs.AI 84%

Just Enough Shifts: Mitigating Over-Refusal in Aligned Language Models with Targeted Representation Fine-Tuning

Mahavir Dabas, Si Chen, Charles Fleming, Ming Jin, Ruoxi Jia

机构 * Department of Electrical and Computer Engineering, Virginia Tech, Blacksburg, VA, USA(弗吉尼亚理工学院与州立大学电气与计算机工程系) Cisco Research, San Jose, CA, USA(思科研究)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20989 2025-06-27 cs.CL cs.LG 84%

Can Gradient Descent Simulate Prompting?

Eric Zhang, Leshem Choshen, Jacob Andreas

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 指令微调 :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20856 2025-06-27 cs.LG cs.CL cs.CR 84%

Leaner Training, Lower Leakage: Revisiting Memorization in LLM Fine-Tuning with LoRA

Fei Wang, Baochun Li

机构 * Department of Electrical and Computer Engineering University of Toronto(电气与计算机工程系 东京大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16212 2025-06-17 cs.CL cs.AI 84%

MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion

Qizhi Pei, Lijun Wu, Zhuoshi Pan, Yu Li, Honglin Lin, Chenlin Ming, Xin Gao, Conghui He, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部下一代智能搜索与推荐工程技术研究中心) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02308 2025-06-10 cs.LG cs.AI 84%

MINT: Multimodal Instruction Tuning with Multimodal Interaction Grouping

Xiaojun Shan, Qi Cao, Xing Han, Haofei Yu, Paul Pu Liang

机构 * University of California, San Diego(加州大学圣地亚哥分校) Johns Hopkins University(约翰霍普金斯大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :instruction tuning(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19583 2025-06-03 cs.LG cs.CL 84%

Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning

Hanlu Zhang, Yumeng Ma, Shuo Wang, Guiran Liu, Binrong Zhu

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22704 2025-05-30 cs.CL cs.AI 84%

Training Language Models to Generate Quality Code with Program Analysis Feedback

Feng Yao, Zilong Wang, Liyuan Liu, Junxia Cui, Li Zhong, Xiaohan Fu, Haohui Mai, Vish Krishnan, Jianfeng Gao, Jingbo Shang

机构 * University of California, San Diego(加州大学圣迭戈分校) Microsoft Research(微软研究院) CausalFlow Inc.(CausalFlow公司)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14807 2025-05-29 cs.MA cs.AI cs.LG 84%

A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health

Nikhil Behari, Edwin Zhang, Yunfan Zhao, Aparna Taneja, Dheeraj Nagaraj, Milind Tambe

机构 * MIT(麻省理工学院) Harvard University(哈佛大学) GE Healthcare(通用电气医疗) Google(谷歌)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Journal ref Advances in Neural Information Processing Systems 37 (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11492 2025-05-27 cs.AI cs.CL cs.CV 84%

Why Vision Language Models Struggle with Visual Arithmetic? Towards Enhanced Chart and Geometry Understanding

Kung-Hsiang Huang, Can Qin, Haoyi Qiu, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu

机构 * Salesforce AI Research(Salesforce AI研究院) UCLA(加州大学洛杉矶分校)

专题命中 指令微调 :language model(title,abstract);post-training(abstract);分类 cs.CL、cs.AI

Comments Code and data are available at https://github.com/SalesforceAIResearch/CogAlign

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06814 2025-05-27 cs.LG cs.AI cs.GR 84%

Diffusion Instruction Tuning

Chen Jin, Ryutaro Tanno, Amrutha Saseendran, Tom Diethe, Philip Teare

专题命中 指令微调 :instruction tuning(title);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

Comments Project page at https://astrazeneca.github.io/vlm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17151 2025-05-26 cs.CL cs.AI 84%

Bayesian Optimization for Enhanced Language Models: Optimizing Acquisition Functions

Zishuo Bao, Yibo Liu, Changyutao Qiu

机构 * Fuzhou University(福州大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Dalian University of Technology(大连理工大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03439 2025-05-07 cs.AI cs.CR cs.LG 84%

The Steganographic Potentials of Language Models

Artem Karpov, Tinuade Adeleke, Seong Hah Cho, Natalia Perez-Campanero

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Published at Building Trust Workshop at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02625 2025-05-06 cs.CL cs.AI cs.SD eess.AS 84%

LLaMA-Omni2: LLM-based Real-time Spoken Chatbot with Autoregressive Streaming Speech Synthesis

Qingkai Fang, Yan Zhou, Shoutao Guo, Shaolei Zhang, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院) Key Laboratory of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Preprint. Project: https://github.com/ictnlp/LLaMA-Omni2

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02467 2025-04-30 cs.LG cs.CL cs.CR 84%

DP-2Stage: Adapting Language Models as Differentially Private Tabular Data Generators

Tejumade Afonja, Hui-Po Wang, Raouf Kerkouche, Mario Fritz

机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全研究中心)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Journal ref Transactions on Machine Learning Research (03/2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14100 2025-04-22 eess.SP cs.AI cs.LG 84%

6G WavesFM: A Foundation Model for Sensing, Communication, and Localization

Ahmed Aboulfotouh, Elsayed Mohammed, Hatem Abou-Zeid

机构 * Department of Electrical and Software Engineering, University of Calgary(电气与软件工程系,卡尔加里大学)

专题命中 指令微调 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12170 2025-04-21 cs.CL cs.AI 84%

Where is the answer? Investigating Positional Bias in Language Model Knowledge Extraction

Kuniaki Saito, Kihyuk Sohn, Chen-Yu Lee, Yoshitaka Ushiku

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Code is published at https://github.com/omron-sinicx/WhereIsTheAnswer

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11019 2025-04-17 cs.LG cs.AI 84%

Unlocking the Power of Function Vectors for Characterizing and Mitigating Catastrophic Forgetting in Continual Instruction Tuning

Gangwei Jiang, Caigao Jiang, Zhaoyi Li, Siqiao Xue, Jun Zhou, Linqi Song, Defu Lian, Ying Wei

专题命中 指令微调 :instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10660 2025-04-16 cs.CL cs.AI 84%

LITERA: An LLM Based Approach to Latin-to-English Translation

Paul Rosu

专题命中 指令微调 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments NAACL Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05855 2025-04-09 cs.CL cs.AI 84%

Enhancing Coreference Resolution with Pretrained Language Models: Bridging the Gap Between Syntax and Semantics

Xingzu Liu, Songhang deng, Mingbang Wang, Zhang Dong, Le Dai, Jiyuan Li, Ruilin Nong

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments acl submission

详情

展开后加载摘要…

URL PDF HTML 收藏