arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12266 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12266 篇

2507.16711 2025-07-23 cs.CL cs.AI 73%

Advancing Risk and Quality Assurance: A RAG Chatbot for Improved Regulatory Compliance

Lars Hillebrand, Armin Berger, Daniel Uedelhoven, David Berghaus, Ulrich Warning, Tim Dilmaghani, Bernd Kliem, Thomas Schmid, Rüdiger Loitz, Rafet Sifa

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted and published at BigData 2024, 3 pages, 3 tables, 2 figures

Journal ref 2024 IEEE International Conference on Big Data (BigData), Washington, DC, USA, 2024, pp. 8668-8670

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15885 2025-07-23 cs.AI cs.HC cs.LG 73%

ADEPTS: A Capability Framework for Human-Centered Agent Design

Pierluca D'Oro, Caley Drooff, Joy Chen, Joseph Tighe

机构 * FAIR at Meta(Meta 的 FAIR)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06656 2025-07-22 eess.AS cs.CL cs.LG cs.SD 73%

Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems

Taejin Park, Ivan Medennikov, Kunal Dhawan, Weiqing Wang, He Huang, Nithin Rao Koluguri, Krishna C. Puvvada, Jagadeesh Balam, Boris Ginsburg

机构 * nvidia

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Published at ICML 2025

Journal ref Proceedings of the 42nd International Conference on Machine Learning (ICML), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13392 2025-07-21 cs.CL cs.AI 73%

TopicImpact: Improving Customer Feedback Analysis with Opinion Units for Topic Modeling and Star-Rating Prediction

Emil Häglund, Johanna Björklund

机构 * Department of Computing Science Umeå University(计算科学系乌梅大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10559 2025-07-17 cs.CY cs.AI cs.CL 73%

NLP Meets the World: Toward Improving Conversations With the Public About Natural Language Processing Research

Shomir Wilson

机构 * Department of Human-Centered Computing and Social Informatics(人机交互与社会信息学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03493 2025-07-15 cs.LG cs.CL 73%

LASER: Attention with Exponential Transformation

Sai Surya Duvvuri, Inderjit S. Dhillon

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) Google(谷歌)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05261 2025-07-10 cs.CL cs.LG 73%

TokenShapley: Token Level Context Attribution with Shapley Value

Yingtai Xiao, Yuqing Zhu, Sirat Samyoun, Wanrong Zhang, Jiachen T. Wang, Jian Du

机构 * TikTok Inc.(字节跳动公司) Princeton University(普林斯顿大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16327 2025-07-09 cs.CR cs.AI cs.CL 73%

Feint and Attack: Attention-Based Strategies for Jailbreaking and Protecting LLMs

Rui Pu, Chaozhuo Li, Rui Ha, Zejian Chen, Litian Zhang, Zheng Liu, Lirong Qiu, Zaisheng Ye

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Hangzhou Dianzi University(杭州电子科技大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Fujian Cancer Hospital(福建癌症医院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01241 2025-07-03 cs.LG cs.AI 73%

Beyond First-Order: Training LLMs with Stochastic Conjugate Subgradients and AdamW

Di Zhang, Yihang Zhang

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21600 2025-06-30 cs.CL cs.AI cs.IR 73%

Structured Attention Matters to Multimodal LLMs in Document Understanding

Chang Liu, Hongkai Chen, Yujun Cai, Hang Wu, Qingwen Ye, Ming-Hsuan Yang, Yiwei Wang

机构 * vivo Mobile Communication Co., Ltd(vivo移动通信有限公司) The University of Queensland(昆士兰大学) University of California, Merced(加州大学默塞德分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15533 2025-06-30 cs.CL cs.AI 73%

LRP4RAG: Detecting Hallucinations in Retrieval-Augmented Generation via Layer-wise Relevance Propagation

Haichuan Hu, Congqing He, Xiaochen Xie, Quanjun Zhang

机构 * Alibaba Cloud(阿里云) School of Computer Sciences, Universiti Sains Malaysia(计算机科学学院,马来西亚国立大学) Department of Service Science and Operations Management, School of Management, Zhejiang University(服务科学与运营管理系,浙江大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18510 2025-06-24 cs.SD cs.AI cs.CL eess.AS 73%

Smooth Operators: LLMs Translating Imperfect Hints into Disfluency-Rich Transcripts

Duygu Altinok

机构 * Independent Researcher(独立研究者)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to INTERSPEECH2025 workshop DISS2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15076 2025-06-19 cs.CL cs.LG 73%

Learning-Time Encoding Shapes Unlearning in LLMs

Ruihan Wu, Konstantin Garov, Kamalika Chaudhuri

机构 * UC, San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13148 2025-06-17 cs.CL cs.AI 73%

Adapting LLMs for Minimal-edit Grammatical Error Correction

Ryszard Staruch, Filip Graliński, Daniel Dzienisiewicz

机构 * Adam Mickiewicz University(亚当·密茨杰夫大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at BEA-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12843 2025-06-17 cs.CL cs.LG 73%

Transforming Chatbot Text: A Sequence-to-Sequence Approach

Natesh Reddy, Mark Stamp

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12270 2025-06-17 cs.AI cs.HC cs.LG cs.SY eess.SY 73%

Cloud Infrastructure Management in the Age of AI Agents

Zhenning Yang, Archit Bhatnagar, Yiming Qiu, Tongyuan Miao, Patrick Tser Jern Kon, Yunming Xiao, Yibo Huang, Martin Casado, Ang Chen

机构 * University of Michigan(密歇根大学) UC Berkeley(伯克利大学) Andreessen Horowitz(安德森-霍尔威兹)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11880 2025-06-16 cs.AI cs.CL 73%

Addressing Bias in LLMs: Strategies and Application to Fair AI-based Recruitment

Alejandro Peña, Julian Fierrez, Aythami Morales, Gonzalo Mancera, Miguel Lopez, Ruben Tolosana

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Submitted to AIES 2025 (Under Review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11415 2025-06-16 cs.LG cs.CL cs.CR 73%

Bias Amplification in RAG: Poisoning Knowledge Retrieval to Steer LLMs

Linlin Wang, Tianqing Zhu, Laiqiao Qin, Longxiang Gao, Wanlei Zhou

机构 * Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center, Qilu University of Technology (Shandong Academy of Sciences)(计算能力网络与信息安全重点实验室,教育部,山东计算机科学中心,齐鲁工业大学(山东科学院)) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing, Shandong Fundamental Research Center for Computer Science(山东省计算能力互联网与服务计算重点实验室,山东省计算机科学基础研究中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11125 2025-06-16 cs.CL cs.AI 73%

ASRJam: Human-Friendly AI Speech Jamming to Prevent Automated Phone Scams

Freddie Grabovski, Gilad Gressel, Yisroel Mirsky

机构 * UW–Madison(威斯康星大学麦迪逊分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16694 2025-06-11 cs.CL cs.AI 73%

Beyond Induction Heads: In-Context Meta Learning Induces Multi-Phase Circuit Emergence

Gouki Minegishi, Hiroki Furuta, Shohei Taniguchi, Yusuke Iwasawa, Yutaka Matsuo

机构 * The University of Tokyo(东京大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08008 2025-06-10 cs.CV cs.AI cs.LG 73%

Hidden in plain sight: VLMs overlook their visual representations

Stephanie Fu, Tyler Bonnen, Devin Guillory, Trevor Darrell

机构 * UC Berkeley(伯克利大学)

专题命中 其他LLM :LLM(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Project page: https://hidden-plain-sight.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20279 2025-06-10 cs.CL cs.AI cs.CR 73%

sudo rm -rf agentic_security

Sejin Lee, Jian Kim, Haon Park, Ashkan Yousefpour, Sangyoon Yu, Min Song

机构 * Aim Intelligence Yonsei University(延世大学) Seoul National University(首尔国立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted ACL 2025 Industry track

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04859 2025-06-09 cs.LG cs.AI 73%

Sparse Autoencoders, Again?

Yin Lu, Xuening Zhu, Tong He, David Wipf

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to the International Conference on Machine Learning (ICML) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13779 2025-06-04 cs.LG cs.AI 73%

Not Every AI Problem is a Data Problem: We Should Be Intentional About Data Scaling

Tanya Rodchenko, Natasha Noy, Nino Scherrer

机构 * Google, Technology & Society(谷歌科技与社会) Google Research(谷歌研究) Google, Paradigms of Intelligence(谷歌智能范式)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05710 2025-06-03 cs.CL cs.AI cs.IR 73%

PromptRefine: Enhancing Few-Shot Performance on Low-Resource Indic Languages with Example Selection from Related Example Banks

Soumya Suvra Ghosal, Soumyabrata Pal, Koyel Mukherjee, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学 College Park 分校) Adobe Research(Adobe 研究)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04037 2025-06-02 cs.CL cs.LG 73%

Exploring Imbalanced Annotations for Effective In-Context Learning

Hongfu Gao, Feipeng Zhang, Hao Zeng, Deyu Meng, Bingyi Jing, Hongxin Wei

机构 * Department of Statistics and Data Science, Southern University of Science and Technology(南方科技大学统计与数据科学系) School of Economics and Finance, Xi’an Jiaotong University(西安交通大学经济金融学院) School of Mathematics and Statistics, Xi’an Jiaotong University(西安交通大学数学与统计学学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23191 2025-05-30 cs.CL cs.AI 73%

ExpeTrans: LLMs Are Experiential Transfer Learners

Jinglong Gao, Xiao Ding, Lingxiao Zou, Bibo Cai, Bing Qin, Ting Liu

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 12 figs/tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22939 2025-05-30 cs.GT cs.AI cs.LG 73%

Generative Social Choice: The Next Generation

Niclas Boehmer, Sara Fish, Ariel D. Procaccia

机构 * Hasso Plattner Institute(哈索普拉特纳研究所) Harvard University(哈佛大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09638 2025-05-30 cs.CL cs.AI 73%

Jailbreaking to Jailbreak

Jeremy Kritz, Vaughn Robinson, Robert Vacareanu, Bijan Varjavand, Michael Choi, Bobby Gogov, Scale Red Team, Summer Yue, Willow E. Primack, Zifan Wang

机构 * Scale AI

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21040 2025-05-29 cs.CL cs.AI 73%

FCKT: Fine-Grained Cross-Task Knowledge Transfer with Semantic Contrastive Learning for Targeted Sentiment Analysis

Wei Chen, Zhao Zhang, Meng Yuan, Kepeng Xu, Fuzhen Zhuang

机构 * School of Artificial Intelligence, Beihang University, China(北京航空航天大学人工智能学院) School of Computer Science and Engineering, Beihang University, China(北京航空航天大学计算机科学与工程学院) Xidian University, China(西安电子科技大学) Zhongguancun Laboratory, China(中关村实验室)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏