arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12229 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12229 篇

2507.19113 2025-07-28 cs.SE 80%

Exploring the Use of LLMs for Requirements Specification in an IT Consulting Company

Liliana Pasquale, Azzurra Ragone, Emanuele Piemontese, Armin Amiri Darban

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 11 pages, 5 figures. Accepted for presentation at the Industrial Innovation Track of the 33rd IEEE International Requirements Engineering Conference (RE 2025), Valencia, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10968 2025-07-22 cs.AI cs.CL cs.LG cs.SE 80%

Combinatorial Optimization for All: Using LLMs to Aid Non-Experts in Improving Optimization Algorithms

Camilo Chacón Sartori, Christian Blum

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13284 2025-06-23 cs.CL cs.AI cs.LG 80%

Learning to Route LLMs with Confidence Tokens

Yu-Neng Chuang, Prathusha Kameswara Sarma, Parikshit Gopalan, John Boccio, Sara Bolouki, Xia Hu, Helen Zhou

机构 * Rice University(里士大学) Apple, Inc.(苹果公司)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02732 2025-06-09 cs.LG cs.AI cs.CL 80%

Peri-LN: Revisiting Normalization Layer in the Transformer Architecture

Jeonghoon Kim, Byeongchan Lee, Cheonbok Park, Yeontaek Oh, Beomjun Kim, Taehwan Yoo, Seongjin Shin, Dongyoon Han, Jinwoo Shin, Kang Min Yoo

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML2025 Camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18151 2025-06-03 cs.CY cs.HC 80%

Howzat? Appealing to Expert Judgement for Evaluating Human and AI Next-Step Hints for Novice Programmers

Neil C. C. Brown, Pierre Weill-Tessier, Juho Leinonen, Paul Denny, Michael Kölling

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 36 pages, 14 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16697 2025-05-23 cs.SE 80%

Software Architecture Meets LLMs: A Systematic Literature Review

Larissa Schmid, Tobias Hey, Martin Armbruster, Sophie Corallo, Dominik Fuchß, Jan Keim, Haoyu Liu, Anne Koziolek

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10639 2025-03-12 cs.CV cs.AI cs.CL cs.LG 80%

MTA: Multimodal Task Alignment for BEV Perception and Captioning

Yunsheng Ma, Burhaneddin Yaman, Xin Ye, Jingru Luo, Feng Tao, Abhirup Mallik, Ziran Wang, Liu Ren

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06615 2025-03-04 cs.CL cs.AI cs.LG cs.RO 80%

Language Guided Skill Discovery

Seungeun Rho, Laura Smith, Tianyu Li, Sergey Levine, Xue Bin Peng, Sehoon Ha

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07088 2025-02-12 cs.CY cs.AI cs.CL cs.HC cs.LG 80%

Kernels of Selfhood: GPT-4o shows humanlike patterns of cognitive consistency moderated by free choice

Steven A. Lehr, Ketan S. Saichandran, Eddie Harmon-Jones, Nykko Vitali, Mahzarin R. Banaji

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Main Article: 10 pages, Supporting Information: 61 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01154 2025-02-04 cs.CL cs.AI cs.CR cs.LG 80%

Jailbreaking with Universal Multi-Prompts

Yu-Ling Hsu, Hsuan Su, Shang-Tse Chen

专题命中 其他LLM :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by NAACL Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19361 2025-02-03 cs.CY cs.AI cs.CL cs.LG 80%

We're Different, We're the Same: Creative Homogeneity Across LLMs

Emily Wenger, Yoed Kenett

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.11156 2025-01-20 cs.CL cs.AI cs.LG 80%

Can AI-Generated Text be Reliably Detected?

Vinu Sankar Sadasivan, Aounon Kumar, Sriram Balasubramanian, Wenxiao Wang, Soheil Feizi

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08542 2024-12-12 cs.AI cs.CL cs.LG 80%

MaestroMotif: Skill Design from Artificial Intelligence Feedback

Martin Klissarov, Mikael Henaff, Roberta Raileanu, Shagun Sodhani, Pascal Vincent, Amy Zhang, Pierre-Luc Bacon, Doina Precup, Marlos C. Machado, Pierluca D'Oro

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02326 2024-12-03 cs.AR cs.AI cs.CL cs.LG cs.PL 80%

Evaluating LLMs for Hardware Design and Test

Jason Blocklove, Siddharth Garg, Ramesh Karri, Hammond Pearce

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11206 2024-11-19 cs.CL cs.AI cs.LG 80%

Capturing Sparks of Abstraction for the ARC Challenge

Martin Andrews

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Submitted as a paper entry for the 2024 ARC Prize

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09539 2024-11-11 cs.CL cs.AI cs.CR cs.LG 80%

Logits of API-Protected LLMs Leak Proprietary Information

Matthew Finlayson, Xiang Ren, Swabha Swayamdipta

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05120 2024-10-14 cs.CL cs.AI cs.LG 80%

More Agents Is All You Need

Junyou Li, Qin Zhang, Yangbin Yu, Qiang Fu, Deheng Ye

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published at Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09177 2024-10-03 cs.LG cs.AI cs.CL 80%

Leveraging the Context through Multi-Round Interactions for Jailbreaking Attacks

Yixin Cheng, Markos Georgopoulos, Volkan Cevher, Grigorios G. Chrysos

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10559 2024-09-18 cs.LG cs.AI cs.CL math.OC stat.ML 80%

Unveiling Induction Heads: Provable Training Dynamics and Feature Learning in Transformers

Siyu Chen, Heejune Sheen, Tianhao Wang, Zhuoran Yang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 100 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07060 2024-08-14 cs.SE cs.AI cs.CL cs.LG 80%

Diversity Empowers Intelligence: Integrating Expertise of Software Engineering Agents

Kexun Zhang, Weiran Yao, Zuxin Liu, Yihao Feng, Zhiwei Liu, Rithesh Murthy, Tian Lan, Lei Li, Renze Lou, Jiacheng Xu, Bo Pang, Yingbo Zhou, Shelby Heinecke, Silvio Savarese, Huan Wang, Caiming Xiong

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14032 2024-07-22 cs.CV 80%

Semantic-CC: Boosting Remote Sensing Image Change Captioning via Foundational Knowledge and Semantic Guidance

Yongshuo Zhu, Lu Li, Keyan Chen, Chenyang Liu, Fugen Zhou, Zhenwei Shi

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01403 2024-07-02 cs.IR cs.AI cs.CL cs.LG 80%

Optimization of Retrieval-Augmented Generation Context with Outlier Detection

Vitaly Bulgakov

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13250 2024-06-21 cs.AI cs.CL cs.LG 80%

LangTopo: Aligning Language Descriptions of Graphs with Tokenized Topological Modeling

Zhong Guan, Hongke Zhao, Likang Wu, Ming He, Jianpin Fan

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11780 2024-06-18 cs.LG cs.AI cs.CL 80%

Split, Unlearn, Merge: Leveraging Data Attributes for More Effective Unlearning in LLMs

Swanand Ravindra Kadhe, Farhan Ahmed, Dennis Wei, Nathalie Baracaldo, Inkit Padhi

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03031 2024-05-14 cs.CL cs.AI cs.CY cs.LG 80%

How Prevalent is Gender Bias in ChatGPT? -- Exploring German and English ChatGPT Responses

Stefanie Urchs, Veronika Thurner, Matthias Aßenmacher, Christian Heumann, Stephanie Thiemichen

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted @ "1st Workshop on Biased Data in Conversational Agents" (co-located with ECML PKDD 2023). This is the author's version of the work. The definite version of record will be published in the proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19358 2024-04-05 cs.CL cs.AI cs.LG 80%

Stable Anisotropic Regularization

William Rudman, Carsten Eickhoff

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Camera-ready version for ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07368 2024-02-13 cs.LG cs.AI cs.CL cs.CY 80%

Assessing Generalization for Subpopulation Representative Modeling via In-Context Learning

Gabriel Simmons, Vladislav Savinov

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to PERSONALIZE workshop at EACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09841 2023-11-17 cs.CL cs.AI cs.DB cs.LG 80%

Leveraging LLMs in Scholarly Knowledge Graph Question Answering

Tilahun Abedissa Taffa, Ricardo Usbeck

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.03838 2023-10-25 cs.CL cs.AI cs.LG 80%

RADAR: Robust AI-Text Detection via Adversarial Learning

Xiaomeng Hu, Pin-Yu Chen, Tsung-Yi Ho

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by NeurIPS 2023. Project page and demos: https://radar.vizhub.ai

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10544 2023-09-20 cs.LG cs.AI cs.CL cs.CR 80%

Model Leeching: An Extraction Attack Targeting LLMs

Lewis Birch, William Hackett, Stefan Trawicki, Neeraj Suri, Peter Garraghan

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏